SkillTrustBench
安全已核验最近更新 2026-10-04
面向 Agent Skill 的安全基准,用例提炼自真实技能市场。
腾讯朱雀实验室与香港中文大学(深圳)于 2026 年 6 月发布的 SkillTrustBench,从主流技能市场的 62,652 个真实 Skill 中提炼出 5,520 个评测用例,覆盖九类攻击。
关键事实
| 2026 前沿 | 5,520 个评测用例,覆盖 9 类攻击(T01-T09)与 5 个依赖层 |
|---|---|
| 可信度 | 其价值在于来源规模:用例提炼自主流技能市场中 62,652 个真实 Skill,因此测的是真实发布出来的威胁,而非凭空设计的攻击。2026 年 6 月由腾讯朱雀实验室与香港中文大学(深圳)联合发布。 |
| 核验状态 | 已核验 |
| 来源 | Tencent Zhuque Lab / CUHK-Shenzhen |
FAQ
SkillTrustBench 测的是什么?
面向 Agent Skill 的安全基准,用例提炼自真实技能市场。
SkillTrustBench 的 2026 年前沿水平是多少?
5,520 个评测用例,覆盖 9 类攻击(T01-T09)与 5 个依赖层
SkillTrustBench 可信吗?
其价值在于来源规模:用例提炼自主流技能市场中 62,652 个真实 Skill,因此测的是真实发布出来的威胁,而非凭空设计的攻击。2026 年 6 月由腾讯朱雀实验室与香港中文大学(深圳)联合发布。