#Agent Security Bench

共 1 条 · 7 天 1 条 · 30 天 1 条
信息流里打上「Agent Security Bench」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月5日
论文提出 TPRS 指标:智能体安全基准得分会因工具命名方式而波动

这篇论文做了件很扎实的事:只改工具名字,GPT-5-mini 和 Claude Haiku 4.5 的安全得分就波动十几个百分点,以后看智能体安全跑分得多留个心眼。

事件专题
arXiv cs.AI@Neeraj Karamchandani 等 5 人2 个信源在谈原文