← 返回方案库
Qwen3-235B-A22B-Instruct-2507
235B MoE 22B active·LLM·专家
预估硬件成本
¥42.00
Qwen3-235B-A22B-Instruct-2507 部署装机示意图235B MoE 22B active专家
部署装机4× A100 80GB·320 GB 总显存
vLLM · FP8/INT4

硬件配置

GPU 型号
4× A100 80GB
总显存
320 GB
内存
256 GB
存储
480 GB
量化方式
FP8/INT4
推理引擎
vLLM

性能与场景

生成速度
25 tokens/s
适用场景
旗舰推理/代码/数学
部署难度
专家
数据来源
🟢 实测参考
测试环境
4x A100 80GB 320GB 总显存 · vLLM FP8/INT4
Qwen3旗舰MoE模型,235B总参22B激活,FP8需4xA100-80G,INT4降至2x。性能接近GPT-4o。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。