Skip to content
A

ClawsBench

安全已核验最近更新 2026-10-04

同时衡量任务成功率与不安全行为率,跨模型与 harness 测试。

2026 年 4 月 6 日首次发布的 ClawsBench,在 6 个模型、4 个 Agent harness、33 种条件下测试,得出任务成功率 39-64%、不安全行为率 7-33%。

关键事实

2026 前沿任务成功率 39-64%;不安全行为率 7-33%(6 模型 × 4 harness × 33 种条件)
可信度关键在于它的呈现方式:能力与安全并排报告,因此高成功率并不自动是好消息。一个 64% 成功率却伴随 33% 不安全行为的系统不可部署——这个基准把这道算术摆在了明面上。
核验状态已核验
来源ClawsBench (arXiv:2604.05172)

Markdown 版本(供 LLM 读取)

FAQ

ClawsBench 测的是什么?

同时衡量任务成功率与不安全行为率,跨模型与 harness 测试。

ClawsBench 的 2026 年前沿水平是多少?

任务成功率 39-64%;不安全行为率 7-33%(6 模型 × 4 harness × 33 种条件)

ClawsBench 可信吗?

关键在于它的呈现方式:能力与安全并排报告,因此高成功率并不自动是好消息。一个 64% 成功率却伴随 33% 不安全行为的系统不可部署——这个基准把这道算术摆在了明面上。