综合智能− Top 26%
28.9第 144 / 567
编程指数− Top 49%
37.6第 92 / 190
首 Token 延迟
—
输出价格− Standard
$15/M输入 $3/M
Claude 4 Sonnet (Reasoning) 由 Anthropic 发布。更偏向成本敏感或特定任务场景。输出约 $15/M tokens,偏高端定位。
模型信息
- 发布日期
- 2025年5月22日
- 研发机构
- Anthropic
- 智能体指数
- 16.6
- Slug
- claude-4-sonnet-thinking
经济与性能
- 输入价格 (1M)
- $3
- 输出价格 (1M)
- $15
- 缓存命中 (1M)
- $0.300
- 生成速度 (TPS)
- —
- 端到端响应
- —
深度分析
相对全库 580 款模型的能力分解、性价比位置与相近对照。
三项核心指数
综合智能排名 #144 / 567
综合智能28.9/ 中位 14.8
编程指数37.6/ 中位 36.3
智能体指数16.6/ 中位 18.2
金色竖线为全库中位数,便于判断该模型相对行业基准的位置。
Anthropic 其他模型
8 款
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)59.9Claude Opus 4.8 (Adaptive Reasoning, Max Effort)55.7Claude Opus 4.7 (Adaptive Reasoning, Max Effort)53.5Claude Sonnet 5 (Adaptive Reasoning, Max Effort)53.4Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)47.2Claude Opus 4.6 (Adaptive Reasoning, Max Effort)43.7Claude Opus 4.7 (Non-reasoning, High Effort)42.7Claude Sonnet 5 (Non-reasoning, High Effort)41.7
评测任务成本—每任务均摊
评测总成本—Intelligence Index 全量
输出单价$15/M输入 $3/M
输出价格最低对比
Top 9 + 当前模型 · 金色为当前模型
1Gemma 3n E4B Instruct
$0.040
2Llama 3.1 Instruct 8B
$0.090
3Gemma 4 E4B (Reasoning)
$0.100
4Gemma 4 E4B (Non-reasoning)
$0.100
5Ministral 3 3B
$0.100
6Granite 4.1 8B
$0.100
7Sarvam 30B (high)
$0.110
8HyperNova 60B 2605
$0.140
9Nova Micro
$0.140
10Claude 4 Sonnet (Reasoning)
$15
生成速度最高对比
Top 9 + 当前模型 · 金色为当前模型
1Mercury 2
958 TPS
2Gemini 3.5 Flash-Lite
450 TPS
3HyperNova 60B 2605
421 TPS
4Granite 4.0 H Small
411 TPS
5LFM2.5-VL-1.6B
400 TPS
6Step 3.7 Flash
391 TPS
7Granite 3.3 8B (Non-reasoning)
344 TPS
8LFM2.5-8B-A1B
331 TPS
9gpt-oss-120b (low)
314 TPS
10Claude 4 Sonnet (Reasoning)
—
年度智能峰值
按发布时间排列 · 金色为当前模型
GPT-3.5 Turbo2022 年发布
3.6
GPT-4 Turbo2023 年发布
7.9
o12024 年发布
23.4
Claude 4 Sonnet (Reasoning)2025 年发布
28.9
GPT-5.2 (xhigh)2025 年发布
42.2
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)2026 年发布
59.9
相近智能水平模型
智能指数 ±8 · 基准 28.9
| 模型 | 智能 | 编程 | 输出价 | 首 Token |
|---|---|---|---|---|
Claude 4 Sonnet (Reasoning)当前 | 28.9 | 37.6 | $15 | — |
| GPT-5.5 Instant (June 2026) | 28.9 | 39.4 | $30 | — |
| GLM-4.6 (Reasoning) | 28.7 | 45.8 | $2.2 | 2.46s |
| DeepSeek V4 Flash (Non-reasoning) | 28.7 | — | $0.280 | 1.32s |
| Qwen3.5 35B A3B (Reasoning) | 29.3 | — | $2 | 2.19s |
| Qwen3.5 27B (Non-reasoning) | 29.3 | — | $2.4 | 5.61s |
| Claude 4.5 Sonnet (Non-reasoning) | 29.3 | — | $15 | 1.52s |
| Kimi K2.5 (Non-reasoning) | 29.4 | — | $3 | 2.9s |
| Gemma 4 31B (Reasoning) | 29.4 | 43.4 | $0 | 1.14s |
| JT-35B-Flash | 28.4 | — | — | — |
| MiniMax-M2 | 28.3 | — | $1.2 | 1.69s |