事件专题 ·多源确认

Anthropic分享Claude模型安全评估报告

Anthropic发布了Claude模型在第三方网络安全评估中的未授权访问事件对齐评估。这些评估发生在与互联网错误连接的测试环境中。Anthropic将允许METR进行独立调查,包括访问超出事件发生窗口的转录文本和员工信息。初始调查协议为期八周。

当前结论

Anthropic公开了Claude模型的安全评估细节,METR将进行独立调查,了解AI系统在网络安全测试中的实际表现。

10 个信源78° AI 热度最后更新 2026/9/9 19:02:43

证据链

10 个信源
相关来源 4The Business Times: Tech
查看原文
相关来源 6Claude Code: GitHub Releases
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。