Qwen3-30B-A3B
30B (MoE, 3B active)·LLM·入门
预估硬件成本
¥0.70万
30B (MoE, 3B active)入门部署装机1× NVIDIA RTX 4070/3080 10-12GB·18 GB 总显存
Ollama / llama.cpp · GGUF Q4_K_M
硬件配置
- GPU 型号
- 1× NVIDIA RTX 4070/3080 10-12GB
- 总显存
- 18 GB
- 内存
- 32 GB
- 存储
- 18 GB
- 量化方式
- GGUF Q4_K_M
- 推理引擎
- Ollama / llama.cpp
性能与场景
- 生成速度
- 45 tokens/s
- 适用场景
- MoE高效推理、消费级显卡跑大参数模型
- 部署难度
- 入门
- 数据来源
- 🟢 实测参考
- 测试环境
- NVIDIA RTX 4070/3080 10-12GB 18GB · Ollama / llama.cpp GGUF Q4_K_M
⭐MoE性价比神器!30B参数仅激活3B,推理速度接近小模型,质量媲美大模型。10-12GB显存即可运行,消费级显卡的终极方案。