CanRunAI

Open-weight local model

Google Gemma 3 12B IT

Balanced multimodal model. Text estimates exclude image encoder and vision activation peaks.

Parameters
12B
Recommended quantization
Q4_K_M
Weight estimate
8.2GB
Maximum context
128K

Official model card

Quantization memory at the default context

QuantizationWeightsKV cacheTotal VRAM
FP1624.50GB1.61GB28.56GB
Q8_013.50GB1.61GB16.46GB
Q6_K10.24GB1.61GB12.87GB
Q5_K_M8.66GB1.61GB11.14GB
Q4_K_M8.20GB1.61GB10.63GB
Q3_K_M6.80GB1.61GB9.21GB

GPUs to check for this model