← 返回方案库
Llama 4 Scout 17B
17B·LLM·进阶
预估硬件成本
¥1.80
Llama 4 Scout 17B 部署装机示意图17B进阶
部署装机1× RTX 4090/3090·16 GB 总显存
Ollama/llama.cpp · GGUF Q5_K_M

硬件配置

GPU 型号
1× RTX 4090/3090
总显存
16 GB
内存
32 GB
存储
15 GB
量化方式
GGUF Q5_K_M
推理引擎
Ollama/llama.cpp

性能与场景

生成速度
30 tokens/s
适用场景
多模态理解、通用对话、代码辅助
部署难度
进阶
数据来源
🟢 实测参考
测试环境
RTX 4090/3090 16GB · Ollama/llama.cpp GGUF Q5_K_M
Meta最新Llama 4 Scout,17B参数支持10M上下文窗口。MoE架构,单卡4090即可运行。支持多模态输入,性价比优秀的消费级部署方案。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。