← 返回方案库
Qwen3-235B-A22B-Instruct-2507
235B (MoE, 22B激活)·LLM·专家
预估硬件成本
¥50.00
Qwen3-235B-A22B-Instruct-2507 部署装机示意图235B (MoE, 22B激活)专家
部署装机4× A100 80GB x4 / H100 x2·240 GB 总显存
vLLM / SGLang · FP8 / INT4 GPTQ

硬件配置

GPU 型号
4× A100 80GB x4 / H100 x2
总显存
240 GB
内存
128 GB
存储
250 GB
量化方式
FP8 / INT4 GPTQ
推理引擎
vLLM / SGLang

性能与场景

生成速度
20 tokens/s
适用场景
企业级旗舰部署,顶级推理代码数学能力
部署难度
专家
数据来源
🟢 实测参考
测试环境
4x A100 80GB x4 / H100 x2 240GB 总显存 · vLLM / SGLang FP8 / INT4 GPTQ
Qwen3旗舰MoE模型235B总参/22B激活。2507版推理能力大幅跃升,数学代码Agent能力对标GPT-4o。FP8需4xA100 80GB,INT4可压缩至2卡。推荐vLLM高吞吐部署。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。