行业资讯

Claude Opus 5.2灰度上线,彻底告别偷懒病

Heooo 09月15日10时00分 28 阅读

「Claude Opus 5.2 已在 Claude Code 中开启灰度测试,前端名称仍是 Opus 5,实际请求已被悄悄路由到新模型。开发者实测显示,其响应速度明显提升,输出干净利落,还能自动进入严酷循环自我迭代,彻底告别偷懒病。Anthropic 内部另有 Model 2 与 RSI 等更深层布局。」

Claude Opus 5.2 已在 Claude Code 中开启灰度测试。多位开发者反馈,前端调用时显示的名称依然是 Opus 5,但通过抓包和查看请求状态可以发现,背后的模型 slug 已经指向了 Opus 5.2。这也就意味着,Anthropic 大概率直接跳过了 5.1 版本。

有开发者指出,昨晚在 Claude Code 中调用 Opus 5 时,其表现与网页版 Opus 5 截然不同,仿佛降维打击。这正是前沿 AI 大厂常用的障眼法——路由:用户看到的入口名称没有变化,实际请求却被悄悄分发到了新一代模型上。

根据开发者的实测反馈,这次升级可以用快、准、狠三个字来概括。首先是响应速度狂飙,相比 Opus 5 的慢条斯理,路由到 5.2 之后生成速度有肉眼可见的飞跃;其次是输出干净利落,废话极少,在代码生成和长文本处理上的完成度直接拉开一个档次。

最受关注的变化,是彻底告别了偷懒病。面对复杂长任务,不少模型习惯让用户反复点击继续,或者只给一个框架让用户自己填充;Opus 5.2 则表现得像个工作狂,有开发者称,它甚至不需要催促,就会自动进入所谓的严酷循环,不断自我迭代和完善代码,直到任务完成为止。

那么,如何判断自己的账号有没有被灰度选中?开发者发现了一个巧妙的探针:在关闭联网搜索的情况下询问你知道重置哥 Tibo 是谁吗,不要搜索。旧版训练数据和权重里没有相关信息,网页版 Opus 5 会一脸茫然,而被路由到 Opus 5.2 的账号则能精准识别并解释其由来,答案不一致就说明权重不同。

灰度之外,Anthropic 内部其实还有更深的布局。早在 8 月中旬,一份曝光的内部风险报告就显示,Opus 5.2 并非底牌,内部可能有三套可以叠加的方案。第一层是 Claude Fable 5.2,最快能够对外落地,结合眼下 Opus 5.2 的灰度节奏,5.2 家族预计最快本月底、最迟下个月底全面推向市场。

第二层是内部代号 Model 2 的神秘模型,在用于测试真实 AI 研发任务的 CoBench v2 榜单上打出了 62.8% 的高分,比当前公认最强模型 Mythos 5 高出 12.5 分。内部人士称,Anthropic 如今大部分公司代码都由 Model 2 跑 Agent 写出,官方口径则是暂时不对外发布。

第三层则是 RSI,即递归自我改进。官方数据称,RSI 模型将替代自家研究团队高达 85% 的工作,性能比 Model 2 还要高出 22 分。

从长任务中的自主迭代,到内部模型接管代码编写,再到递归自我改进替代大部分研究工作,Anthropic 的路径正变得越来越清晰:让 AI 创造更好的 AI。对开发者而言,眼下最实际的动作,或许就是在 Claude Code 里做一次探针测试,看看自己有没有提前拿到这张入场券。

# Claude Opus 5.2 # Anthropic # AI模型

来源:Heooo AI工具导航