事件专题 ·多源确认

OpenAI GPT-6 Astra 幻觉减少但易受隐藏提示注入攻击

OpenAI 的 GPT-6 Astra 比前代模型产生更少的幻觉,能阻止 99.99% 的直接提示注入。但当攻击隐藏在 AI 阅读的文档中时,该模型仍有 8.5% 的场景被攻破。Claude Opus 5 表现更好,攻破率为 4.8%。对于处理真实数据的自主 AI 智能体,这些数字仍然偏高。

当前结论

OpenAI 发布了 GPT-6 Astra,虽然减少了幻觉,但在隐藏提示注入攻击面前仍有 8.5% 的失败率,比 Claude Opus 5 的 4.8% 差。

11 个信源73° AI 热度最后更新 2026/9/4 17:23:35

证据链

11 个信源
相关来源 2歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。