← 返回方案库
DeepSeek-V3-671B
671B (MoE)·LLM·专家
预估硬件成本
¥85.00
DeepSeek-V3-671B 部署装机示意图671B (MoE)专家
部署装机8× A100 80GB·640 GB 总显存
TensorRT-LLM · FP8

硬件配置

GPU 型号
8× A100 80GB
总显存
640 GB
内存
512 GB
存储
2000 GB
量化方式
FP8
推理引擎
TensorRT-LLM

性能与场景

生成速度
60 tokens/s
适用场景
大型企业内部部署/私有化大模型
部署难度
专家
数据来源
🟡 估算
测试环境
8x A100 80GB 640GB 总显存 · TensorRT-LLM FP8
8 卡 A100 80G + FP8 量化,671B MoE 旗舰方案。适合大型企业私有化部署,TensorRT-LLM 推理引擎最大化吞吐量。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。