OpenAI GPT-6 Astra 幻觉减少但易受隐藏提示注入攻击
OpenAI's GPT-6 Astra hallucinates less but remains vulnerable to hidden prompt injections
OpenAI 发布了 GPT-6 Astra,虽然减少了幻觉,但在隐藏提示注入攻击面前仍有 8.5% 的失败率,比 Claude Opus 5 的 4.8% 差。
OpenAI 的 GPT-6 Astra 比前代模型产生更少的幻觉,能阻止 99.99% 的直接提示注入。但当攻击隐藏在 AI 阅读的文档中时,该模型仍有 8.5% 的场景被攻破。Claude Opus 5 表现更好,攻破率为 4.8%。对于处理真实数据的自主 AI 智能体,这些数字仍然偏高。
OpenAI's GPT-6 Astra hallucinates less but remains vulnerable to hidden prompt injections
OpenAI's GPT-6 Astra hallucinates less than its predecessor and blocks 99.99 percent of direct prompt injections. But when attacks are hidden inside documents the AI reads, the model still gets cracked in 8.5 percent of scenarios. Claude Opus 5 does better at 4.8 percent. For autonomous AI agents handling real data, those numbers still seem high. The article OpenAI's GPT-6 Astra hallucinates less but remains vulnerable to hidden prompt injections appeared first on The Decoder .