← 返回方案库
Qwen3-235B-A22B-Instruct-2507
235B-A22B·LLM·专家
预估硬件成本
¥45.00
Qwen3-235B-A22B-Instruct-2507 部署装机示意图235B-A22B专家
部署装机2× A100 80G/H100·160 GB 总显存
vLLM/SGLang · FP8/INT4

硬件配置

GPU 型号
2× A100 80G/H100
总显存
160 GB
内存
128 GB
存储
150 GB
量化方式
FP8/INT4
推理引擎
vLLM/SGLang

性能与场景

生成速度
15 tokens/s
适用场景
企业级应用、复杂推理、长文本处理
部署难度
专家
数据来源
🟡 估算
测试环境
2x A100 80G/H100 160GB 总显存 · vLLM/SGLang FP8/INT4
Qwen3旗舰MoE模型,235B总参数22B激活。2507版本支持256K上下文(可扩展至1M)。需要多卡A100/H100,适合企业级部署。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。