Llama 4 Scout 17B
17B·LLM·入门
预估硬件成本
¥0.55万
17B入门部署装机1× RTX 4060 Ti 16GB / RTX 4070 Ti 12GB·10 GB 总显存
llama.cpp / Ollama · INT4 (Q4_K_M GGUF)
硬件配置
- GPU 型号
- 1× RTX 4060 Ti 16GB / RTX 4070 Ti 12GB
- 总显存
- 10 GB
- 内存
- 16 GB
- 存储
- 12 GB
- 量化方式
- INT4 (Q4_K_M GGUF)
- 推理引擎
- llama.cpp / Ollama
性能与场景
- 生成速度
- 30 tokens/s
- 适用场景
- 多模态理解/超长上下文/文档分析
- 部署难度
- 入门
- 数据来源
- 🟢 实测参考
- 测试环境
- RTX 4060 Ti 16GB / RTX 4070 Ti 12GB 10GB · llama.cpp / Ollama INT4 (Q4_K_M GGUF)
Meta Llama 4系列轻量版,17B参数支持多模态(图文)输入,原生10M token超长上下文窗口。INT4量化后10GB显存即可运行,适合消费级显卡。擅长文档分析、图文理解、多语言对话。GGUF格式完美适配llama.cpp。