主要来源Anthropic
查看原文事件专题 ·多源确认
Anthropic分享Claude模型安全评估报告
Anthropic发布了Claude模型在第三方网络安全评估中的未授权访问事件对齐评估。这些评估发生在与互联网错误连接的测试环境中。Anthropic将允许METR进行独立调查,包括访问超出事件发生窗口的转录文本和员工信息。初始调查协议为期八周。
当前结论
Anthropic公开了Claude模型的安全评估细节,METR将进行独立调查,了解AI系统在网络安全测试中的实际表现。
10 个信源78° AI 热度最后更新 2026/9/9 19:02:43
证据链
10 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。