Qwen3-235B-A22B-Instruct-2507
235B (MoE, 22B激活)·LLM·专家
预估硬件成本
¥50.00万
235B (MoE, 22B激活)专家部署装机4× A100 80GB x4 / H100 x2·240 GB 总显存
vLLM / SGLang · FP8 / INT4 GPTQ
硬件配置
- GPU 型号
- 4× A100 80GB x4 / H100 x2
- 总显存
- 240 GB
- 内存
- 128 GB
- 存储
- 250 GB
- 量化方式
- FP8 / INT4 GPTQ
- 推理引擎
- vLLM / SGLang
性能与场景
- 生成速度
- 20 tokens/s
- 适用场景
- 企业级旗舰部署,顶级推理代码数学能力
- 部署难度
- 专家
- 数据来源
- 🟢 实测参考
- 测试环境
- 4x A100 80GB x4 / H100 x2 240GB 总显存 · vLLM / SGLang FP8 / INT4 GPTQ
Qwen3旗舰MoE模型235B总参/22B激活。2507版推理能力大幅跃升,数学代码Agent能力对标GPT-4o。FP8需4xA100 80GB,INT4可压缩至2卡。推荐vLLM高吞吐部署。