Qwen3-235B-A22B-Instruct-2507
235B-A22B (MoE)·LLM·专家
预估硬件成本
¥42.00万
235B-A22B (MoE)专家部署装机4× A100 80GB / H100 80GB·280 GB 总显存
vLLM / SGLang · FP8 / AWQ INT4
硬件配置
- GPU 型号
- 4× A100 80GB / H100 80GB
- 总显存
- 280 GB
- 内存
- 256 GB
- 存储
- 500 GB
- 量化方式
- FP8 / AWQ INT4
- 推理引擎
- vLLM / SGLang
性能与场景
- 生成速度
- 20 tokens/s
- 适用场景
- 企业级部署、科研、顶级推理能力
- 部署难度
- 专家
- 数据来源
- 🟢 实测参考
- 测试环境
- 4x A100 80GB / H100 80GB 280GB 总显存 · vLLM / SGLang FP8 / AWQ INT4
Qwen3旗舰MoE模型,235B总参22B激活。FP8精度需4卡A100/H100。Thinking版本在数学/代码/推理任务达到开源SOTA。支持1M tokens超长上下文。