GPU × 本地模型兼容性
RTX 4090 24GB 能运行 DeepSeek R1 Distill Qwen 32B 吗?
不行——该模型超过可用显存。
该组合在推荐量化下约需 24.59GB 显存,比当前 GPU 多 0.59GB;下方提供更小模型和合适 GPU。
24.59GB显存需求
24.00GB当前显存
0.59GB显存缺口
Q4_K_M推荐量化
8K上下文
较轻的 Q2_K / 8K 配置可以运行。
计算估算,不是实测 benchmark。
GPU × 本地模型兼容性
该组合在推荐量化下约需 24.59GB 显存,比当前 GPU 多 0.59GB;下方提供更小模型和合适 GPU。
较轻的 Q2_K / 8K 配置可以运行。
计算估算,不是实测 benchmark。