Qwen3-30B-A3B
30B (MoE, 3B激活)·LLM·入门
预估硬件成本
¥1.50万
30B (MoE, 3B激活)入门部署装机1× RTX 4090 24GB / RTX 3090·18 GB 总显存
Ollama / llama.cpp · Q4_K_M (GGUF) / INT8
硬件配置
- GPU 型号
- 1× RTX 4090 24GB / RTX 3090
- 总显存
- 18 GB
- 内存
- 32 GB
- 存储
- 60 GB
- 量化方式
- Q4_K_M (GGUF) / INT8
- 推理引擎
- Ollama / llama.cpp
性能与场景
- 生成速度
- 45 tokens/s
- 适用场景
- 日常对话/轻量推理/消费级部署
- 部署难度
- 入门
- 数据来源
- 🟢 实测参考
- 测试环境
- RTX 4090 24GB / RTX 3090 18GB · Ollama / llama.cpp Q4_K_M (GGUF) / INT8
⭐性价比之王!30B总参但仅3B激活的MoE架构,Q4量化后仅需18GB显存,单张RTX 4090即可流畅运行。性能超越同尺寸密集模型,适合个人开发者和小团队。