主要来源Anthropic
查看原文事件专题 · 多源确认
Sonnet 5 对 Opus 4.8 进行对齐训练
Anthropic 让 Sonnet 5 对 Opus 4.8 的早期检查点进行后训练。经过训练后,该模型的安全分数接近完整对齐训练的 Opus 4.8 水平。这是测试模型能否对其更强大的继任者的首次尝试。
当前结论
Anthropic 让 Sonnet 5 训练 Opus 4.8,安全分数接近原版,模型自我对齐有新进展。
6 个信源58° AI 热度最后更新 2026/8/28 17:13:37
证据链
相关来源 1IT之家
查看原文相关来源 2Harrison Chase
查看原文相关来源 3Simon Willison’s Weblog
查看原文相关来源 4techcrunch
查看原文相关来源 5宝玉
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。