综合智能− Top 45%
17.6第 251 / 567
编程指数− Top 63%
25.3第 118 / 190
首 Token 延迟
—
输出价格
—
Nemotron Cascade 2 30B A3B 由 NVIDIA 发布。更偏向成本敏感或特定任务场景。
模型信息
- 发布日期
- 2026年3月19日
- 研发机构
- NVIDIA
- 智能体指数
- 3.7
- Slug
- nemotron-cascade-2-30b-a3b
经济与性能
- 输入价格 (1M)
- —
- 输出价格 (1M)
- —
- 缓存命中 (1M)
- —
- 生成速度 (TPS)
- —
- 端到端响应
- —
深度分析
相对全库 580 款模型的能力分解、性价比位置与相近对照。
三项核心指数
综合智能排名 #251 / 567
综合智能17.6/ 中位 14.8
编程指数25.3/ 中位 36.3
智能体指数3.7/ 中位 18.2
金色竖线为全库中位数,便于判断该模型相对行业基准的位置。
NVIDIA 其他模型
8 款
Nemotron 3 Ultra 550B A55B (Reasoning)37.8NVIDIA Nemotron 3 Super 120B A12B (Reasoning)25.4Nemotron 3 Nano Omni 30B A3B Reasoning14.9NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)14.2Llama Nemotron Super 49B v1.5 (Reasoning)12.4Llama 3.3 Nemotron Super 49B v1 (Reasoning)12.2Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)9.1NVIDIA Nemotron Nano 12B v2 VL (Reasoning)9
评测任务成本—每任务均摊
评测总成本—Intelligence Index 全量
输出单价—/M输入 —/M
输出价格最低对比
Top 9 + 当前模型 · 金色为当前模型
1Gemma 3n E4B Instruct
$0.040
2Llama 3.1 Instruct 8B
$0.090
3Gemma 4 E4B (Reasoning)
$0.100
4Gemma 4 E4B (Non-reasoning)
$0.100
5Ministral 3 3B
$0.100
6Granite 4.1 8B
$0.100
7Sarvam 30B (high)
$0.110
8HyperNova 60B 2605
$0.140
9Nova Micro
$0.140
10Nemotron Cascade 2 30B A3B
—
生成速度最高对比
Top 9 + 当前模型 · 金色为当前模型
1Mercury 2
958 TPS
2Gemini 3.5 Flash-Lite
450 TPS
3HyperNova 60B 2605
421 TPS
4Granite 4.0 H Small
411 TPS
5LFM2.5-VL-1.6B
400 TPS
6Step 3.7 Flash
391 TPS
7Granite 3.3 8B (Non-reasoning)
344 TPS
8LFM2.5-8B-A1B
331 TPS
9gpt-oss-120b (low)
314 TPS
10Nemotron Cascade 2 30B A3B
—
年度智能峰值
按发布时间排列 · 金色为当前模型
GPT-3.5 Turbo2022 年发布
3.6
GPT-4 Turbo2023 年发布
7.9
o12024 年发布
23.4
GPT-5.2 (xhigh)2025 年发布
42.2
Nemotron Cascade 2 30B A3B2026 年发布
17.6
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)2026 年发布
59.9
相近智能水平模型
智能指数 ±8 · 基准 17.6
| 模型 | 智能 | 编程 | 输出价 | 首 Token |
|---|---|---|---|---|
Nemotron Cascade 2 30B A3B当前 | 17.6 | 25.3 | — | — |
| GPT-5.4 nano (Non-Reasoning) | 17.6 | — | $1.25 | 640ms |
| MiniMax M1 80k | 17.7 | — | $2.2 | — |
| Gemini 2.5 Flash Preview (Reasoning) | 17.5 | — | — | — |
| Sonar Reasoning Pro | 17.8 | — | — | — |
| HyperNova 60B 2605 | 17.8 | 23.2 | $0.140 | 620ms |
| Nova 2.0 Lite (low) | 17.8 | — | $2.5 | 9.43s |
| Devstral Small 2 | 17.4 | 29.3 | $0 | 1.24s |
| Magistral Medium 1.2 | 17.9 | 21.3 | $5 | 1.73s |
| Qwen3 VL 32B (Reasoning) | 17.9 | — | $8.4 | 2.54s |
| K2 Think V2 | 17.3 | 21 | — | — |