← 返回方案库
Qwen3.5-397B-A17B
397B/17B激活·LLM·专家
预估硬件成本
¥95.00
Qwen3.5-397B-A17B 部署装机示意图397B/17B激活专家
部署装机8× 8×A100 80GB·240 GB 总显存
vLLM · INT4/FP8

硬件配置

GPU 型号
8× 8×A100 80GB
总显存
240 GB
内存
256 GB
存储
800 GB
量化方式
INT4/FP8
推理引擎
vLLM

性能与场景

生成速度
20 tokens/s
适用场景
企业级AI助手/复杂推理
部署难度
专家
数据来源
🟢 实测参考
测试环境
8x 8×A100 80GB 240GB 总显存 · vLLM INT4/FP8
Qwen3.5旗舰,MoE+混合注意力,256K上下文,原生多模态

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。