综合智能− Top 52%
14.2第 294 / 567
编程指数− Top 81%
14.4第 153 / 190
首 Token 延迟− Top 32%
1.44s端到端 21.45s
输出价格↑ Cost-effective
$0.200/M输入 $0.050/M
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning) 由 NVIDIA 发布。更偏向成本敏感或特定任务场景。输出约 $0.200/M tokens,性价比突出。
模型信息
- 发布日期
- 2025年12月15日
- 研发机构
- NVIDIA
- 智能体指数
- 2
- Slug
- nvidia-nemotron-3-nano-30b-a3b-reasoning
经济与性能
- 输入价格 (1M)
- $0.050
- 输出价格 (1M)
- $0.200
- 缓存命中 (1M)
- —
- 生成速度 (TPS)
- 125 tok/s
- 端到端响应
- 21.45s
深度分析
相对全库 580 款模型的能力分解、性价比位置与相近对照。
三项核心指数
综合智能排名 #294 / 567
综合智能14.2/ 中位 14.8
编程指数14.4/ 中位 36.3
智能体指数2/ 中位 18.2
金色竖线为全库中位数,便于判断该模型相对行业基准的位置。
NVIDIA 其他模型
8 款
Nemotron 3 Ultra 550B A55B (Reasoning)37.8NVIDIA Nemotron 3 Super 120B A12B (Reasoning)25.4Nemotron Cascade 2 30B A3B17.6Nemotron 3 Nano Omni 30B A3B Reasoning14.9Llama Nemotron Super 49B v1.5 (Reasoning)12.4Llama 3.3 Nemotron Super 49B v1 (Reasoning)12.2Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)9.1NVIDIA Nemotron Nano 12B v2 VL (Reasoning)9
评测任务成本$0.0183每任务均摊
评测总成本$39Intelligence Index 全量
输出单价$0.200/M输入 $0.050/M
输出价格最低对比
Top 9 + 当前模型 · 金色为当前模型
1Gemma 3n E4B Instruct
$0.040
2Llama 3.1 Instruct 8B
$0.090
3Gemma 4 E4B (Reasoning)
$0.100
4Gemma 4 E4B (Non-reasoning)
$0.100
5Ministral 3 3B
$0.100
6Granite 4.1 8B
$0.100
7Sarvam 30B (high)
$0.110
8HyperNova 60B 2605
$0.140
9Nova Micro
$0.140
10NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)
$0.200
生成速度最高对比
Top 9 + 当前模型 · 金色为当前模型
1Mercury 2
958 TPS
2Gemini 3.5 Flash-Lite
450 TPS
3HyperNova 60B 2605
421 TPS
4Granite 4.0 H Small
411 TPS
5LFM2.5-VL-1.6B
400 TPS
6Step 3.7 Flash
391 TPS
7Granite 3.3 8B (Non-reasoning)
344 TPS
8LFM2.5-8B-A1B
331 TPS
9gpt-oss-120b (low)
314 TPS
10NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)
125 TPS
年度智能峰值
按发布时间排列 · 金色为当前模型
GPT-3.5 Turbo2022 年发布
3.6
GPT-4 Turbo2023 年发布
7.9
o12024 年发布
23.4
GPT-5.2 (xhigh)2025 年发布
42.2
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)2025 年发布
14.2
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)2026 年发布
59.9
相近智能水平模型
智能指数 ±8 · 基准 14.2
| 模型 | 智能 | 编程 | 输出价 | 首 Token |
|---|---|---|---|---|
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)当前 | 14.2 | 14.4 | $0.200 | 1.44s |
| DeepSeek V3 (Dec '24) | 14.2 | 23 | $0.890 | — |
| K2-V2 (high) | 14.2 | — | — | — |
| Gemini 2.5 Flash (Non-reasoning) | 14.1 | — | $2.5 | 540ms |
| Ling 2.6 Flash | 14.1 | 25.3 | $0.300 | 1.13s |
| Solar Pro 3 | 14.1 | 16.2 | — | — |
| gpt-oss-20b (low) | 14.3 | — | $0.200 | 880ms |
| Llama 4 Maverick | 14.3 | 16.3 | $0.850 | 970ms |
| GPT-5 mini (minimal) | 14.3 | — | $2 | 940ms |
| Qwen3 VL 235B A22B Instruct | 14.3 | — | $2.8 | 2.67s |
| o1-mini | 14 | — | — | — |