← 返回方案库
GLM-5.2
745B MoE 44B active·LLM·专家
预估硬件成本
¥45.00
GLM-5.2 部署装机示意图745B MoE 44B active专家
部署装机2× A100 80GB / H100·160 GB 总显存
vLLM / SGLang · INT4 / FP8

硬件配置

GPU 型号
2× A100 80GB / H100
总显存
160 GB
内存
256 GB
存储
400 GB
量化方式
INT4 / FP8
推理引擎
vLLM / SGLang

性能与场景

生成速度
15 tokens/s
适用场景
百万级长文本/代码Agent/企业部署
部署难度
专家
数据来源
🟡 估算
测试环境
2x A100 80GB / H100 160GB 总显存 · vLLM / SGLang INT4 / FP8
智谱2026年6月开源旗舰模型,MIT协议。745B总参/44B激活MoE,100万token无损上下文。需多卡专业GPU。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。