Llama 4 Scout 17B
17B·LLM·进阶
预估硬件成本
¥1.80万
17B进阶部署装机1× RTX 4090/3090·16 GB 总显存
Ollama/llama.cpp · GGUF Q5_K_M
硬件配置
- GPU 型号
- 1× RTX 4090/3090
- 总显存
- 16 GB
- 内存
- 32 GB
- 存储
- 15 GB
- 量化方式
- GGUF Q5_K_M
- 推理引擎
- Ollama/llama.cpp
性能与场景
- 生成速度
- 30 tokens/s
- 适用场景
- 多模态理解、通用对话、代码辅助
- 部署难度
- 进阶
- 数据来源
- 🟢 实测参考
- 测试环境
- RTX 4090/3090 16GB · Ollama/llama.cpp GGUF Q5_K_M
Meta最新Llama 4 Scout,17B参数支持10M上下文窗口。MoE架构,单卡4090即可运行。支持多模态输入,性价比优秀的消费级部署方案。