← 返回方案库
Qwen3-30B-A3B
30B (MoE, 3B激活)·LLM·入门
预估硬件成本
¥1.50
Qwen3-30B-A3B 部署装机示意图30B (MoE, 3B激活)入门
部署装机1× RTX 4090 24GB / RTX 3090·18 GB 总显存
Ollama / llama.cpp · Q4_K_M (GGUF) / INT8

硬件配置

GPU 型号
1× RTX 4090 24GB / RTX 3090
总显存
18 GB
内存
32 GB
存储
60 GB
量化方式
Q4_K_M (GGUF) / INT8
推理引擎
Ollama / llama.cpp

性能与场景

生成速度
45 tokens/s
适用场景
日常对话/轻量推理/消费级部署
部署难度
入门
数据来源
🟢 实测参考
测试环境
RTX 4090 24GB / RTX 3090 18GB · Ollama / llama.cpp Q4_K_M (GGUF) / INT8
⭐性价比之王!30B总参但仅3B激活的MoE架构,Q4量化后仅需18GB显存,单张RTX 4090即可流畅运行。性能超越同尺寸密集模型,适合个人开发者和小团队。

想部署这套方案?

留下您的联系方式,模力Lab 团队 24 小时内回复,提供从硬件选型到部署落地的全流程支持。