CanRunAI

Open-weight local model

Mistral Small 3.1 24B Instruct

High-quality local multimodal model. Text estimates exclude vision overhead; 24GB is the practical Q4 target.

Parameters
24B
Recommended quantization
Q4_K_M
Weight estimate
15GB
Maximum context
128K

Official model card

Quantization memory at the default context

QuantizationWeightsKV cacheTotal VRAM
FP1648.50GB1.34GB54.69GB
Q8_026.50GB1.34GB30.49GB
Q6_K20.48GB1.34GB23.86GB
Q5_K_M17.32GB1.34GB20.40GB
Q4_K_M15.00GB1.34GB17.84GB
Q3_K_M12.40GB1.34GB14.98GB
Q2_K7.88GB1.34GB10.02GB

GPUs to check for this model