ML
模力Lab
· 开源大模型本地部署
首页
方案库
知识库
方案生成器
MCP 接入
关于
首页
方案库
知识库
方案生成器
搜索
方案库
共 12 个方案,按你的需求筛选 · 勾选最多 3 个可对比
类型
全部
LLM
LLM (Reasoning)
VLM
难度
进阶
排序
成本
性能
显存从小到大
对比
Qwen3-30B-A3B-Instruct-2507
30B-A3B MoE · LLM
进阶
GPU
1× RTX 4090 24GB
显存
20 GB
推理引擎
Ollama vLLM llama.cpp
性能
35 tok/s
预估成本
¥1.50
万
详情 →
对比
Qwen3-30B-A3B-Instruct-2507
30B · LLM
进阶
GPU
1× RTX 4090
显存
24 GB
推理引擎
Ollama
性能
40 tok/s
预估成本
¥1.50
万
详情 →
对比
Qwen3-30B-A3B-Instruct-2507
30B-A3B · LLM
进阶
GPU
1× RTX 4090/3090
显存
24 GB
推理引擎
Ollama/llama.cpp/vLLM
性能
25 tok/s
预估成本
¥1.50
万
详情 →
对比
Qwen3-14B
14B · LLM
进阶
GPU
1× RTX 4090 24GB / A5000
显存
22 GB
推理引擎
Ollama / vLLM
性能
35 tok/s
预估成本
¥1.60
万
详情 →
对比
Qwen2.5-7B (Fine-tuned)
7B · LLM
进阶
GPU
1× RTX 4090
显存
24 GB
推理引擎
LLaMA-Factory
性能
35 tok/s
预估成本
¥1.80
万
详情 →
对比
Llama 4 Scout 17B
17B · LLM
进阶
GPU
1× RTX 4090/3090
显存
16 GB
推理引擎
Ollama/llama.cpp
性能
30 tok/s
预估成本
¥1.80
万
详情 →
对比
Llama 4 Scout
109B/17B active · LLM
进阶
GPU
2× 2x RTX 4090 24GB
显存
48 GB
推理引擎
llama.cpp/Ollama
性能
30 tok/s
预估成本
¥3.60
万
详情 →
对比
DeepSeek-R1-Distill-32B
32B · LLM (Reasoning)
进阶
GPU
2× RTX 4090
显存
48 GB
推理引擎
vLLM
性能
18 tok/s
预估成本
¥4.00
万
详情 →
对比
Qwen2.5-Coder-32B
32B · LLM
进阶
GPU
2× RTX 4090
显存
48 GB
推理引擎
vLLM
性能
32 tok/s
预估成本
¥4.20
万
详情 →
对比
Qwen2.5-72B
72B · LLM
进阶
GPU
4× RTX 4090
显存
96 GB
推理引擎
vLLM
性能
45 tok/s
预估成本
¥8.50
万
详情 →
对比
Qwen2-VL-72B
72B · VLM
进阶
GPU
4× RTX 4090
显存
96 GB
推理引擎
vLLM
性能
25 tok/s
预估成本
¥8.80
万
详情 →
对比
Llama-3.1-70B
70B · LLM
进阶
GPU
2× A100 80GB
显存
160 GB
推理引擎
vLLM
性能
55 tok/s
预估成本
¥22.00
万
详情 →