Llama 4 Scout
109B/17B active·LLM·进阶
预估硬件成本
¥3.60万
109B/17B active进阶部署装机2× 2x RTX 4090 24GB·48 GB 总显存
llama.cpp/Ollama · GGUF Q4_K_M
硬件配置
- GPU 型号
- 2× 2x RTX 4090 24GB
- 总显存
- 48 GB
- 内存
- 64 GB
- 存储
- 220 GB
- 量化方式
- GGUF Q4_K_M
- 推理引擎
- llama.cpp/Ollama
性能与场景
- 生成速度
- 30 tokens/s
- 适用场景
- 10M超长上下文多模态
- 部署难度
- 进阶
- 数据来源
- 🟢 实测参考
- 测试环境
- 2x 2x RTX 4090 24GB 48GB 总显存 · llama.cpp/Ollama GGUF Q4_K_M
Meta最新Llama4系列,Scout支持10M上下文窗口。MoE架构109B总参/17B激活,双卡4090可跑。