Qwen3-30B-A3B
30B/3B active·LLM·入门
预估硬件成本
¥1.50万
30B/3B active入门部署装机1× RTX 4090 24GB·18 GB 总显存
Ollama/llama.cpp · GGUF Q4_K_M
硬件配置
- GPU 型号
- 1× RTX 4090 24GB
- 总显存
- 18 GB
- 内存
- 32 GB
- 存储
- 60 GB
- 量化方式
- GGUF Q4_K_M
- 推理引擎
- Ollama/llama.cpp
性能与场景
- 生成速度
- 45 tokens/s
- 适用场景
- 消费级显卡跑MoE大模型
- 部署难度
- 入门
- 数据来源
- 🟢 实测参考
- 测试环境
- RTX 4090 24GB 18GB · Ollama/llama.cpp GGUF Q4_K_M
超高性价比MoE模型,30B总参仅3B激活。单卡RTX4090即可流畅运行,性能媲美Qwen2.5-7B。