论文Agent 与开发者10:21AI安全基准测试的心理学审计这篇论文揭示了AI安全基准测试的测量问题,特别是HarmBench数据集无法准确衡量单一安全属性。#HELM Safety#HarmBench#AI安全#基准测试aarXiv cs.AI@Christopher M. Stewart 等 8 人原文稍后读已读值得跟进有用关注 HELM Safety