Skip to content
A

AgentPerf

基础设施已核验最近更新 2026-10-04

Artificial Analysis 面向 Agentic AI 基础设施的基准,基于真实编码 Agent 轨迹构建。

Artificial Analysis 与 NVIDIA 于 2026 年 6 月 12 日发布的 AgentPerf 显示,NVIDIA GB300 NVL72 在 20 tok/s SLO 下达 91,507 agents/MW,最高为 HGX H200 的 20 倍;但在 60 tok/s SLO 下变为约 61,400 对 2,600。

常见的错误说法: 只引用「最高 20 倍」而不说明 SLO——不同 SLO 下该比值相差约 5 倍。

关键事实

2026 前沿在 20 tok/s SLO 下,NVIDIA GB300 NVL72 达 91,507 agents/MW,最高为 HGX H200 的 20 倍
可信度这是基础设施基准而非模型基准:衡量的是单位电力预算能支撑多少 Agent。两点需注意——该基准与 NVIDIA 合作开发(因此 NVIDIA 领先属预期),且结果对所选 SLO 高度敏感,例如 60 tok/s 时 GB300 约 61,400 agents/MW,而 H200 约 2,600。
核验状态已核验
来源Artificial Analysis hardware benchmarks

Markdown 版本(供 LLM 读取)

FAQ

AgentPerf 测的是什么?

Artificial Analysis 面向 Agentic AI 基础设施的基准,基于真实编码 Agent 轨迹构建。

AgentPerf 的 2026 年前沿水平是多少?

在 20 tok/s SLO 下,NVIDIA GB300 NVL72 达 91,507 agents/MW,最高为 HGX H200 的 20 倍

AgentPerf 可信吗?

这是基础设施基准而非模型基准:衡量的是单位电力预算能支撑多少 Agent。两点需注意——该基准与 NVIDIA 合作开发(因此 NVIDIA 领先属预期),且结果对所选 SLO 高度敏感,例如 60 tok/s 时 GB300 约 61,400 agents/MW,而 H200 约 2,600。

关于 AgentPerf 的常见说法准确吗?

只引用「最高 20 倍」而不说明 SLO——不同 SLO 下该比值相差约 5 倍。