Oriel
NVIDIALLM#379
Nvidia

Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)

综合智能 Top 67%
9.1第 379 / 567
编程指数
首 Token 延迟 Top 54%
2.36s端到端 49.91s
输出价格 Standard
$1.8/M输入 $0.600/M

Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) 由 NVIDIA 发布。更偏向成本敏感或特定任务场景。输出约 $1.8/M tokens,价格处于中游。

模型信息

发布日期
2025年4月7日
研发机构
NvidiaNVIDIA
智能体指数
Slug
llama-3-1-nemotron-ultra-253b-v1-reasoning

经济与性能

输入价格 (1M)
$0.600
输出价格 (1M)
$1.8
缓存命中 (1M)
生成速度 (TPS)
53 tok/s
端到端响应
49.91s

深度分析

相对全库 580 款模型的能力分解、性价比位置与相近对照。