CanRunAI

オープンウェイトモデル

Qwen 3 30B A3B

MoE model: all quantized weights must fit, while active parameters affect calculated speed.

パラメータ
30.532B
推奨量子化
Q4_K_M
重み推定
18.8GB
最大コンテキスト
40K

公式モデルカード

既定コンテキストでの量子化メモリ

量子化重みKV cache合計VRAM
FP1661.50GB0.81GB68.46GB
Q8_033.50GB0.81GB37.66GB
Q6_K26.05GB0.81GB29.46GB
Q5_K_M22.04GB0.81GB25.05GB
Q4_K_M18.80GB0.81GB21.49GB
Q3_K_M15.60GB0.81GB17.97GB
Q2_K10.02GB0.81GB11.83GB

このモデルを確認するGPU