← 返回方案库
Llama 4 Scout 17B
17B·LLM·入门
预估硬件成本
¥0.55
Llama 4 Scout 17B 部署装机示意图17B入门
部署装机1× RTX 4060 Ti 16GB / RTX 4070 Ti 12GB·10 GB 总显存
llama.cpp / Ollama · INT4 (Q4_K_M GGUF)

硬件配置

GPU 型号
1× RTX 4060 Ti 16GB / RTX 4070 Ti 12GB
总显存
10 GB
内存
16 GB
存储
12 GB
量化方式
INT4 (Q4_K_M GGUF)
推理引擎
llama.cpp / Ollama

性能与场景

生成速度
30 tokens/s
适用场景
多模态理解/超长上下文/文档分析
部署难度
入门
数据来源
🟢 实测参考
测试环境
RTX 4060 Ti 16GB / RTX 4070 Ti 12GB 10GB · llama.cpp / Ollama INT4 (Q4_K_M GGUF)
Meta Llama 4系列轻量版,17B参数支持多模态(图文)输入,原生10M token超长上下文窗口。INT4量化后10GB显存即可运行,适合消费级显卡。擅长文档分析、图文理解、多语言对话。GGUF格式完美适配llama.cpp。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。