8月29日
02:07
02:07官方账号Anthropic@AnthropicAI
精选
Anthropic 让 Sonnet 5 对 Opus 4.8 的早期检查点进行后训练。经过训练后,该模型的安全分数接近完整对齐训练的 Opus 4.8 水平。这是测试模型能否对其更强大的继任者的首次尝试。
事件专题

推荐理由:Anthropic 让 Sonnet 5 训练 Opus 4.8,安全分数接近原版,模型自我对齐有新进展。