Skip to content
A

SkillTrustBench

安全已核验最近更新 2026-10-04

面向 Agent Skill 的安全基准,用例提炼自真实技能市场。

腾讯朱雀实验室与香港中文大学(深圳)于 2026 年 6 月发布的 SkillTrustBench,从主流技能市场的 62,652 个真实 Skill 中提炼出 5,520 个评测用例,覆盖九类攻击。

关键事实

2026 前沿5,520 个评测用例,覆盖 9 类攻击(T01-T09)与 5 个依赖层
可信度其价值在于来源规模:用例提炼自主流技能市场中 62,652 个真实 Skill,因此测的是真实发布出来的威胁,而非凭空设计的攻击。2026 年 6 月由腾讯朱雀实验室与香港中文大学(深圳)联合发布。
核验状态已核验
来源Tencent Zhuque Lab / CUHK-Shenzhen

Markdown 版本(供 LLM 读取)

FAQ

SkillTrustBench 测的是什么?

面向 Agent Skill 的安全基准,用例提炼自真实技能市场。

SkillTrustBench 的 2026 年前沿水平是多少?

5,520 个评测用例,覆盖 9 类攻击(T01-T09)与 5 个依赖层

SkillTrustBench 可信吗?

其价值在于来源规模:用例提炼自主流技能市场中 62,652 个真实 Skill,因此测的是真实发布出来的威胁,而非凭空设计的攻击。2026 年 6 月由腾讯朱雀实验室与香港中文大学(深圳)联合发布。