开源权重本地模型
Qwen 3 32B
Large dense reasoning model; Q4 is tight on 24GB once KV cache and runtime overhead are included.
- 参数量
- 32.762B
- 推荐量化
- Q4_K_M
- 权重估算
- 20.4GB
- 最大上下文
- 40K
默认上下文下的量化显存
| 量化 | 权重 | KV cache | 总显存 |
|---|---|---|---|
| FP16 | 66.00GB | 2.15GB | 74.75GB |
| Q8_0 | 36.00GB | 2.15GB | 41.75GB |
| Q6_K | 27.95GB | 2.15GB | 32.89GB |
| Q5_K_M | 23.65GB | 2.15GB | 28.16GB |
| Q4_K_M | 20.40GB | 2.15GB | 24.59GB |
| Q3_K_M | 16.90GB | 2.15GB | 20.74GB |
| Q2_K | 10.75GB | 2.15GB | 13.97GB |
检查这些 GPU 能否运行该模型
- RTX 4060 8GB 能运行吗?
- RTX 5090 32GB 能运行吗?
- RTX 5090 D 32GB 能运行吗?
- RTX 6090 32GB 能运行吗?
- Nvidia TITAN V CEO Edition 32GB 能运行吗?
- Nvidia RTX 5000 Ada Generation 32GB 能运行吗?
- Apple MacBook Pro M4 Max (40-core GPU) 48GB 能运行吗?
- Apple MacBook Pro M3 Max (40-core GPU) 48GB 能运行吗?
- Apple MacBook Pro M4 Pro (16-core GPU) 48GB 能运行吗?