← 返回方案库
Llama 4 Scout
109B/17B active·LLM·进阶
预估硬件成本
¥3.60
Llama 4 Scout 部署装机示意图109B/17B active进阶
部署装机2× 2x RTX 4090 24GB·48 GB 总显存
llama.cpp/Ollama · GGUF Q4_K_M

硬件配置

GPU 型号
2× 2x RTX 4090 24GB
总显存
48 GB
内存
64 GB
存储
220 GB
量化方式
GGUF Q4_K_M
推理引擎
llama.cpp/Ollama

性能与场景

生成速度
30 tokens/s
适用场景
10M超长上下文多模态
部署难度
进阶
数据来源
🟢 实测参考
测试环境
2x 2x RTX 4090 24GB 48GB 总显存 · llama.cpp/Ollama GGUF Q4_K_M
Meta最新Llama4系列,Scout支持10M上下文窗口。MoE架构109B总参/17B激活,双卡4090可跑。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。