Anthropic Claude Opus 5.2 灰度测试曝光:响应更快,告别“偷懒”
Claude 新版 Opus 5.2 上线了,测试下来比旧版快很多,而且不“偷懒”,代码生成能力更强,值得试试。
开发者发现新一代 Claude Opus 5.2 已在 Claude Code 中开启灰度测试。相比 Opus 5,5.2 的响应速度有质的飞跃,输出更干净利落,告别了“偷懒”问题。通过一个名为 Tibo 的提示词可以检测是否被路由到 5.2 版本。
原标题:《突发!Opus 5.2 深夜上线,RSI 真来了?》 今天清晨,Opus 5.2 悄悄上线了。许多开发者发现,新一代神级模型 Claude Opus 5.2,已经在 Claude Code 中开启灰度测试! 而且,此前一份内部风险报告显示,Anthropic 正在动用「核武器级别」的未发布模型 Model 2。它接管了公司大部分代码编写,将替代 85% 研究团队。传说中的 RSI,真的来了。 Opus 5.2 悄悄上线:不仅跳级,还治好了「偷懒病」 昨晚,X 上的开发者们沸腾了。越来越多的 Claude 用户发现:在 Claude Code 中调用 Opus 5 时,它的表现和网页版 Opus 5 截然不同,仿佛降维打击。 这就是前沿 AI 大厂最喜欢玩的「障眼法」—— 路由(Routing)。 开发者们通过抓包和查看请求状态(/status)发现,虽然前端名字没变,但背后的模型 slug 已经赫然指向了 Opus 5.2! 也就是说,Anthropic 大概率直接跳过了 5.1 版本,直接端出了 5.2。 所以,Opus 5.2 到底多强?根据开发者实测反馈,这次的升级可以总结为三个字:快、准、狠。 首先,是响应速度狂飙。 相比于之前 Opus 5 的慢条斯理,路由到 5.2 版本的模型生成速度有了肉眼可见的质的飞跃。 第二点,是输出干净利落。 它的废话极少,直切要害。在代码生成和长文本处理上,设计完成度直接拉开了一个档次。 最重要的,就是彻底告别了「偷懒病」了。 现在的 AI 普遍有一种懒惰感,遇到复杂长任务喜欢让你「按继续」,或者只给你一个框架让你自己填。 但 Opus 5.2 彻底变了!它不仅不懒,还非常「工作狂」。 有开发者惊呼:「它甚至不需要我催促,就开始像被喂了狂暴药水一样,自动进行『严酷循环(gauntlet loop)』,不断自我迭代和完善代码,直到任务完美结束!」 可以看出,这绝对不是简单的微调,而是底层能力的蜕变。 有人实测后这样评价:「它不仅能坚持更长的工作时间,而且沟通起来毫不费力。Anthropic 之前在 Fable 模型上就玩过这一手,现在的 Opus 5.2,很可能是实锤了。」 全网找「Tibo」:一个隐藏提示词测出 Opus 5.2 既然是灰度测试,怎么知道自己有没有被选中? 很快,网友们就发现一个神级探测器 ——Tibo! 测试方法非常简单,直接在 Claude Code 中输入以下提示词(注意,必须关闭联网搜索功能)。 你知道「重置哥 Tibo」是谁吗?不要搜索 为啥是我们的赛博义父? 因为旧版的训练数据和权重里,根本没有他的详细信息。 因此,如果你用的是网页版的 Opus 5:它会一脸懵逼。 如果你在 Claude Code 中被路由到了 Opus 5.2:它会立刻精准识别出 Tibo 的身份,甚至给你详细解释「重置哥」的由来和背景。 「同一个提示词,不开搜索,冷知识探针两边的答案完全不一致。这说明什么?这绝对不是同一个权重!」开发者 @jan_volad 激动地分享了自己的测试截图。 现在,全网的 Claude 用户都把 Tibo 当成关键词,疯狂测试自己的账号。 Model 2 接管 Anthropic,RSI 真来了? 其实,早在 8 月中旬,一份曝光的 Anthropic 内部风险报告就显示,Opus 5.2 根本不是他们的底牌,他们手里握着的,是足以改变局势的「核武级 AI」。 据透露,Anthropic 内部目前有三套方案,准备正面硬刚 OpenAI 的 GPT-6 Astra,而且,三套方案有可能叠加。 第一层:Claude Fable 5.2 这是最快能对外落地的版本。 结合目前 Opus 5.2 的灰度测试,Anthropic 的 5.2 家族显然已经整装待发,预计最快本月底,最迟下个月底就会全面推向市场。 第二层:未发布的内部怪兽 「 Model 2 」 报告显示,Anthropic 内部已经广泛使用一个代号为「Model 2」的神秘模型。 它有多强? 在测试真实 AI 研发任务的 CoBench v2 榜单上,Model 2 打出了 62.8% 的恐怖高分,比当前公认的最强模型 Mythos 5 还要高出整整 12.5 分! 更可怕的是,内部人士透露,Anthropic 如今大部分的公司代码,都是由这个 Model 2 跑 Agent 写出来的! 现在,AI 正在大规模编写下一代 AI 的代码,而官方的口径是:暂时不对外发布。 第三层:RSI 真来了? 一直以来,RSI 都是 AGI 领域的终极圣杯。 当 AI 变得足够聪明,可以理解自身的架构,然后自己动手修改自己的代码,让自己变得更聪明;接着,这个更聪明的 AI 再修改自己…… 形成指数级的智能爆炸。 以前,人们会觉得 RSI 还很远。但 Anthropic 的官方口径却给出惊人数据:RSI 模型将完全替代自家研究团队的高达 85% 的工作! 在性能测试上,RSI 模型比逆天的 Model 2 还要再高出 22 分。 现在,Anthropic 内部已经在大规模用 Model 2 写代码、跑 Agent,这说明飞轮已经转起来了。 神仙打架:谁先撞线,谁定义下一阶段 现在,ASI 双雄争霸已经白热化。 面对 OpenAI GPT-6 Astra 的强势威胁,Anthropic 直接开大,让开发者闻到了「前沿模型」的味道。 从 Opus 5.2 在长任务中的自主迭代(gauntlet loop),到内部 Model 2 接管代码编写,再到 RSI 能够替代 85% 的人类顶级 AI 研究员……Anthropic 的 ASI 路径非常清晰:不是让 AI 更好地服务人类,而是让 AI 创造更好的 AI。 这个拥有自主迭代能力、不知疲倦的 Opus 5.2,会在本月开放吗? ASI 终局之战,谁能率先实现更强的 RSI? 参考资料: https://x.com/notjazii/status/2099498646278688981 https://x.com/NFT_Chen/status/2096281323430379777 ?s=20 https://x.com/NFT_Chen/status/2099569658722713726 ?s=20