Llama 4 Maverick
400B/17B active·LLM·专家
预估硬件成本
¥50.00万
400B/17B active专家部署装机4× 4x A100 80GB·280 GB 总显存
vLLM/TensorRT-LLM · FP8/GGUF Q4
硬件配置
- GPU 型号
- 4× 4x A100 80GB
- 总显存
- 280 GB
- 内存
- 128 GB
- 存储
- 800 GB
- 量化方式
- FP8/GGUF Q4
- 推理引擎
- vLLM/TensorRT-LLM
性能与场景
- 生成速度
- 20 tokens/s
- 适用场景
- 企业级多模态旗舰
- 部署难度
- 专家
- 数据来源
- 🟢 实测参考
- 测试环境
- 4x 4x A100 80GB 280GB 总显存 · vLLM/TensorRT-LLM FP8/GGUF Q4
Llama4旗舰版,400B总参17B激活,支持1M上下文。多模态能力强,适合企业级部署。