AgentPerf
基础设施已核验最近更新 2026-10-04
Artificial Analysis 面向 Agentic AI 基础设施的基准,基于真实编码 Agent 轨迹构建。
Artificial Analysis 与 NVIDIA 于 2026 年 6 月 12 日发布的 AgentPerf 显示,NVIDIA GB300 NVL72 在 20 tok/s SLO 下达 91,507 agents/MW,最高为 HGX H200 的 20 倍;但在 60 tok/s SLO 下变为约 61,400 对 2,600。
常见的错误说法: 只引用「最高 20 倍」而不说明 SLO——不同 SLO 下该比值相差约 5 倍。
关键事实
| 2026 前沿 | 在 20 tok/s SLO 下,NVIDIA GB300 NVL72 达 91,507 agents/MW,最高为 HGX H200 的 20 倍 |
|---|---|
| 可信度 | 这是基础设施基准而非模型基准:衡量的是单位电力预算能支撑多少 Agent。两点需注意——该基准与 NVIDIA 合作开发(因此 NVIDIA 领先属预期),且结果对所选 SLO 高度敏感,例如 60 tok/s 时 GB300 约 61,400 agents/MW,而 H200 约 2,600。 |
| 核验状态 | 已核验 |
| 来源 | Artificial Analysis hardware benchmarks |
FAQ
AgentPerf 测的是什么?
Artificial Analysis 面向 Agentic AI 基础设施的基准,基于真实编码 Agent 轨迹构建。
AgentPerf 的 2026 年前沿水平是多少?
在 20 tok/s SLO 下,NVIDIA GB300 NVL72 达 91,507 agents/MW,最高为 HGX H200 的 20 倍
AgentPerf 可信吗?
这是基础设施基准而非模型基准:衡量的是单位电力预算能支撑多少 Agent。两点需注意——该基准与 NVIDIA 合作开发(因此 NVIDIA 领先属预期),且结果对所选 SLO 高度敏感,例如 60 tok/s 时 GB300 约 61,400 agents/MW,而 H200 约 2,600。
关于 AgentPerf 的常见说法准确吗?
只引用「最高 20 倍」而不说明 SLO——不同 SLO 下该比值相差约 5 倍。