← 返回方案库
DeepSeek-R1-Distill-32B
32B·LLM (Reasoning)·进阶
预估硬件成本
¥4.00
DeepSeek-R1-Distill-32B 部署装机示意图32B进阶
部署装机2× RTX 4090·48 GB 总显存
vLLM · INT4

硬件配置

GPU 型号
2× RTX 4090
总显存
48 GB
内存
64 GB
存储
300 GB
量化方式
INT4
推理引擎
vLLM

性能与场景

生成速度
18 tokens/s
适用场景
数学推理/逻辑分析
部署难度
进阶
数据来源
🟡 估算
测试环境
2x RTX 4090 48GB 总显存 · vLLM INT4
双卡 4090 + INT4 量化,推理能力突出。适合数学解题、逻辑分析、复杂推理场景,推理能力接近 GPT-4。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。