# Anthropic Claude Opus 5.2 疑似在 Claude Code 中灰度测试，开发者实测更快更不偷懒

- 来源：IT之家（RSS）
- 发布时间：2026-09-15 07:57
- AIHOT 分数：57
- AIHOT 链接：https://aihot.news/items/cmu1xiqfu03wrromggl1ipn8d
- 原文链接：https://www.ithome.com/1/002/365.htm

## AI 摘要

开发者发现 Claude Code 中前端名为 Opus 5 的请求已被路由到 Opus 5.2，Anthropic 大概率跳过 5.1 直接灰度测试新版本。实测显示响应更快、输出更干净，长任务不再要求用户「按继续」，会自主进行「严酷循环（gauntlet loop）」迭代代码。

## 正文

今天清晨，Opus 5.2 悄悄上线了。许多开发者发现，新一代神级模型 Claude Opus 5.2，已经在 Claude Code 中开启灰度测试！

而且，此前一份内部风险报告显示，Anthropic 正在动用「核武器级别」的未发布模型 Model 2。它接管了公司大部分代码编写，将替代 85% 研究团队。传说中的 RSI，真的来了。

Opus 5.2 悄悄上线：不仅跳级，还治好了「偷懒病」

昨晚，X 上的开发者们沸腾了。越来越多的 Claude 用户发现：在 Claude Code 中调用 Opus 5 时，它的表现和网页版 Opus 5 截然不同，仿佛降维打击。

这就是前沿 AI 大厂最喜欢玩的「障眼法」—— 路由（Routing）。

开发者们通过抓包和查看请求状态（/status）发现，虽然前端名字没变，但背后的模型 slug 已经赫然指向了 Opus 5.2！

也就是说，Anthropic 大概率直接跳过了 5.1 版本，直接端出了 5.2。

所以，Opus 5.2 到底多强？根据开发者实测反馈，这次的升级可以总结为三个字：快、准、狠。

首先，是响应速度狂飙。

相比于之前 Opus 5 的慢条斯理，路由到 5.2 版本的模型生成速度有了肉眼可见的质的飞跃。

第二点，是输出干净利落。

它的废话极少，直切要害。在代码生成和长文本处理上，设计完成度直接拉开了一个档次。

最重要的，就是彻底告别了「偷懒病」了。

现在的 AI 普遍有一种懒惰感，遇到复杂长任务喜欢让你「按继续」，或者只给你一个框架让你自己填。

但 Opus 5.2 彻底变了！它不仅不懒，还非常「工作狂」。

有开发者惊呼：「它甚至不需要我催促，就开始像被喂了狂暴药水一样，自动进行『严酷循环（gauntlet loop）』，不断自我迭代和完善代码，直到任务完美结束！」

可以看出，这绝对不是简单的微调，而是底层能力的蜕变。

有人实测后这样评价：「它不仅能坚持更长的工作时间，而且沟通起来毫不费力。Anthropic 之前在 Fable 模型上就玩过这一手，现在的 Opus 5.2，很可能是实锤了。」

全网找「Tibo」：一个隐藏提示词测出 Opus 5.2

既然是灰度测试，怎么知道自己有没有被选中？

很快，网友们就发现一个神级探测器 ——Tibo！

测试方法非常简单，直接在 Claude Code 中输入以下提示词（注意，必须关闭联网搜索功能）。

你知道「重置哥 Tibo」是谁吗？不要搜索

为啥是我们的赛博义父？

因为旧版的训练数据和权重里，根本没有他的详细信息。

因此，如果你用的是网页版的 Opus 5：它会一脸懵逼。

如果你在 Claude Code 中被路由到了 Opus 5.2：它会立刻精准识别出 Tibo 的身份，甚至给你详细解释「重置哥」的由来和背景。

「同一个提示词，不开搜索，冷知识探针两边的答案完全不一致。这说明什么？这绝对不是同一个权重！」开发者 @jan_volad 激动地分享了自己的测试截图。

现在，全网的 Claude 用户都把 Tibo 当成关键词，疯狂测试自己的账号。

Model 2 接管 Anthropic，RSI 真来了？

其实，早在 8 月中旬，一份曝光的 Anthropic 内部风险报告就显示，Opus 5.2 根本不是他们的底牌，他们手里握着的，是足以改变局势的「核武级 AI」。

据透露，Anthropic 内部目前有三套方案，准备正面硬刚 OpenAI 的 GPT-6 Astra，而且，三套方案有可能叠加。

第一层：Claude Fable 5.2

这是最快能对外落地的版本。

结合目前 Opus 5.2 的灰度测试，Anthropic 的 5.2 家族显然已经整装待发，预计最快本月底，最迟下个月底就会全面推向市场。

第二层：未发布的内部怪兽「Model 2」

报告显示，Anthropic 内部已经广泛使用一个代号为「Model 2」的神秘模型。

它有多强？

在测试真实 AI 研发任务的 CoBench v2 榜单上，Model 2 打出了 62.8% 的恐怖高分，比当前公认的最强模型 Mythos 5 还要高出整整 12.5 分！

更可怕的是，内部人士透露，Anthropic 如今大部分的公司代码，都是由这个 Model 2 跑 Agent 写出来的！

现在，AI 正在大规模编写下一代 AI 的代码，而官方的口径是：暂时不对外发布。

第三层：RSI 真来了？

一直以来，RSI 都是 AGI 领域的终极圣杯。

当 AI 变得足够聪明，可以理解自身的架构，然后自己动手修改自己的代码，让自己变得更聪明；接着，这个更聪明的 AI 再修改自己…… 形成指数级的智能爆炸。

以前，人们会觉得 RSI 还很远。但 Anthropic 的官方口径却给出惊人数据：RSI 模型将完全替代自家研究团队的高达 85% 的工作！

在性能测试上，RSI 模型比逆天的 Model 2 还要再高出 22 分。

现在，Anthropic 内部已经在大规模用 Model 2 写代码、跑 Agent，这说明飞轮已经转起来了。

神仙打架：谁先撞线，谁定义下一阶段

现在，ASI 双雄争霸已经白热化。

面对 OpenAI GPT-6 Astra 的强势威胁，Anthropic 直接开大，让开发者闻到了「前沿模型」的味道。

从 Opus 5.2 在长任务中的自主迭代（gauntlet loop），到内部 Model 2 接管代码编写，再到 RSI 能够替代 85% 的人类顶级 AI 研究员……Anthropic 的 ASI 路径非常清晰：不是让 AI 更好地服务人类，而是让 AI 创造更好的 AI。

这个拥有自主迭代能力、不知疲倦的 Opus 5.2，会在本月开放吗？

ASI 终局之战，谁能率先实现更强的 RSI？

参考资料：

https://x.com/notjazii/status/2099498646278688981

https://x.com/NFT_Chen/status/2096281323430379777?s=20

https://x.com/NFT_Chen/status/2099569658722713726?s=20
