综合智能− Top 82%
6第 460 / 567
编程指数− Top 97%
3.8第 183 / 190
首 Token 延迟↑ Fast
820ms端到端 12.1s
输出价格↑ Cost-effective
$0/M输入 $0/M
Phi-4 Mini Instruct 由 Microsoft 发布。更偏向成本敏感或特定任务场景。输出约 $0/M tokens,性价比突出。
模型信息
- 发布日期
- 2024年2月26日
- 研发机构
- Microsoft
- 智能体指数
- 0.3
- Slug
- phi-4-mini
经济与性能
- 输入价格 (1M)
- $0
- 输出价格 (1M)
- $0
- 缓存命中 (1M)
- —
- 生成速度 (TPS)
- 44 tok/s
- 端到端响应
- 12.1s
深度分析
相对全库 580 款模型的能力分解、性价比位置与相近对照。
三项核心指数
综合智能排名 #460 / 567
综合智能6/ 中位 14.8
编程指数3.8/ 中位 36.3
智能体指数0.3/ 中位 18.2
金色竖线为全库中位数,便于判断该模型相对行业基准的位置。
Microsoft 其他模型
3 款
评测任务成本$0每任务均摊
评测总成本$0Intelligence Index 全量
输出单价$0/M输入 $0/M
输出价格最低对比
Top 9 + 当前模型 · 金色为当前模型
1Phi-4 Mini Instruct
$0
2Gemma 3n E4B Instruct
$0.040
3Llama 3.1 Instruct 8B
$0.090
4Gemma 4 E4B (Reasoning)
$0.100
5Gemma 4 E4B (Non-reasoning)
$0.100
6Ministral 3 3B
$0.100
7Granite 4.1 8B
$0.100
8Sarvam 30B (high)
$0.110
9HyperNova 60B 2605
$0.140
10Nova Micro
$0.140
生成速度最高对比
Top 9 + 当前模型 · 金色为当前模型
1Mercury 2
958 TPS
2Gemini 3.5 Flash-Lite
450 TPS
3HyperNova 60B 2605
421 TPS
4Granite 4.0 H Small
411 TPS
5LFM2.5-VL-1.6B
400 TPS
6Step 3.7 Flash
391 TPS
7Granite 3.3 8B (Non-reasoning)
344 TPS
8LFM2.5-8B-A1B
331 TPS
9gpt-oss-120b (low)
314 TPS
10Phi-4 Mini Instruct
44 TPS
年度智能峰值
按发布时间排列 · 金色为当前模型
GPT-3.5 Turbo2022 年发布
3.6
GPT-4 Turbo2023 年发布
7.9
Phi-4 Mini Instruct2024 年发布
6
o12024 年发布
23.4
GPT-5.2 (xhigh)2025 年发布
42.2
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)2026 年发布
59.9
相近智能水平模型
智能指数 ±8 · 基准 6
| 模型 | 智能 | 编程 | 输出价 | 首 Token |
|---|---|---|---|---|
Phi-4 Mini Instruct当前 | 6 | 3.8 | $0 | 820ms |
| EXAONE 4.0 32B (Non-reasoning) | 6 | — | — | — |
| Grok-1 | 6 | — | — | — |
| Qwen2 Instruct 72B | 6 | — | — | — |
| Llama 3.2 Instruct 90B (Vision) | 6.2 | — | $2.04 | — |
| Solar Mini | 6.2 | — | $0.150 | — |
| Gemini 1.5 Pro (May '24) | 6.3 | 19.8 | — | — |
| Qwen2.5 Turbo | 6.3 | — | $0.200 | 2.15s |
| R1 1776 | 6.3 | — | — | — |
| Reka Flash (Sep '24) | 6.3 | — | $0.800 | 2.41s |
| DeepSeek R1 Distill Llama 8B | 6.4 | — | — | — |