![]()
新智元报道
![]()
今天清晨,Opus 5.2悄悄上线了。
许多开发者发现,新一代神级模型Claude Opus 5.2,已经在 Claude Code 中开启灰度测试!
![]()
而且,此前一份内部风险报告显示,Anthropic正在动用「核武器级别」的未发布模型Model 2。它接管了公司大部分代码编写,将替代85%研究团队。
传说中的RSI,真的来了。
Opus 5.2 悄悄上线:不仅跳级,还治好了「偷懒病」
昨晚,X上的开发者们沸腾了。
越来越多的Claude用户发现:在Claude Code中调用Opus 5时,它的表现和网页版Opus 5截然不同,仿佛降维打击。
![]()
这就是前沿AI大厂最喜欢玩的「障眼法」——路由(Routing)。
开发者们通过抓包和查看请求状态(/status)发现,虽然前端名字没变,但背后的模型slug已经赫然指向了Opus 5.2!
![]()
也就是说,Anthropic大概率直接跳过了5.1版本,直接端出了5.2。
![]()
![]()
![]()
所以,Opus 5.2到底多强?
根据开发者实测反馈,这次的升级可以总结为三个字:快、准、狠。
首先,是响应速度狂飙。
相比于之前Opus 5的慢条斯理,路由到5.2版本的模型生成速度有了肉眼可见的质的飞跃。
![]()
第二点,是输出干净利落。
它的废话极少,直切要害。在代码生成和长文本处理上,设计完成度直接拉开了一个档次。
![]()
最重要的,就是彻底告别了「偷懒病」了。
现在的AI普遍有一种懒惰感,遇到复杂长任务喜欢让你「按继续」,或者只给你一个框架让你自己填。
但Opus 5.2彻底变了! 它不仅不懒,还非常「工作狂」。
![]()
有开发者惊呼:「它甚至不需要我催促,就开始像被喂了狂暴药水一样,自动进行『严酷循环(gauntlet loop)』,不断自我迭代和完善代码,直到任务完美结束!」
![]()
可以看出,这绝对不是简单的微调,而是底层能力的蜕变。
![]()
有人实测后这样评价:「它不仅能坚持更长的工作时间,而且沟通起来毫不费力。Anthropic之前在Fable模型上就玩过这一手,现在的Opus 5.2,很可能是实锤了。」
![]()
全网找「Tibo」:一个隐藏提示词测出Opus 5.2
既然是灰度测试,怎么知道自己有没有被选中?
很快,网友们就发现一个神级探测器——Tibo!
测试方法非常简单,直接在Claude Code 中输入以下提示词(注意,必须关闭联网搜索功能)。
你知道「重置哥 Tibo」是谁吗?不要搜索
![]()
为啥是我们的赛博义父?
因为旧版的训练数据和权重里,根本没有他的详细信息。
因此,如果你用的是网页版的 Opus 5: 它会一脸懵逼。
如果你在 Claude Code 中被路由到了 Opus 5.2: 它会立刻精准识别出Tibo的身份,甚至给你详细解释「重置哥」的由来和背景。
「同一个提示词,不开搜索,冷知识探针两边的答案完全不一致。这说明什么?这绝对不是同一个权重!」开发者 @jan_volad 激动地分享了自己的测试截图。
![]()
现在,全网的Claude用户都把Tibo当成关键词,疯狂测试自己的账号。
Model 2接管Anthropic,RSI真来了?
其实,早在8月中旬,一份曝光的Anthropic 内部风险报告就显示,Opus 5.2 根本不是他们的底牌,他们手里握着的,是足以改变局势的「核武级AI」。
![]()
据透露,Anthropic 内部目前有三套方案,准备正面硬刚 OpenAI的GPT-6 Astra,而且,三套方案有可能叠加。
第一层:Claude Fable 5.2
这是最快能对外落地的版本。
结合目前 Opus 5.2 的灰度测试,Anthropic 的 5.2 家族显然已经整装待发,预计最快本月底,最迟下个月底就会全面推向市场。
第二层:未发布的内部怪兽「Model 2」
报告显示,Anthropic 内部已经广泛使用一个代号为「Model 2」的神秘模型。
它有多强?
在测试真实AI研发任务的 CoBench v2 榜单上,Model 2 打出了 62.8% 的恐怖高分,比当前公认的最强模型 Mythos 5 还要高出整整 12.5 分!
![]()
更可怕的是,内部人士透露,Anthropic 如今大部分的公司代码,都是由这个Model 2跑Agent写出来的!
现在,AI 正在大规模编写下一代 AI 的代码,而官方的口径是:暂时不对外发布。
第三层:RSI真来了?
一直以来,RSI都是AGI领域的终极圣杯。
当AI 变得足够聪明,可以理解自身的架构,然后自己动手修改自己的代码,让自己变得更聪明;接着,这个更聪明的AI再修改自己……形成指数级的智能爆炸。
以前,人们会觉得RSI还很远。但 Anthropic 的官方口径却给出惊人数据:RSI 模型将完全替代自家研究团队的高达 85% 的工作!
在性能测试上,RSI模型比逆天的Model 2还要再高出 22 分。
现在,Anthropic内部已经在大规模用 Model 2 写代码、跑 Agent,这说明飞轮已经转起来了。
![]()
神仙打架:谁先撞线,谁定义下一阶段
现在,ASI双雄争霸已经白热化。
面对OpenAI GPT-6 Astra的强势威胁,Anthropic直接开大,让开发者闻到了「前沿模型」的味道。
从 Opus 5.2 在长任务中的自主迭代(gauntlet loop),到内部 Model 2 接管代码编写,再到 RSI 能够替代 85% 的人类顶级AI研究员……Anthropic的ASI路径非常清晰:不是让 AI 更好地服务人类,而是让 AI 创造更好的 AI。
这个拥有自主迭代能力、不知疲倦的 Opus 5.2,会在本月开放吗?
ASI终局之战,谁能率先实现更强的RSI?
参考资料:
https://x.com/notjazii/status/2099498646278688981
https://x.com/NFT_Chen/status/2096281323430379777?s=20
https://x.com/NFT_Chen/status/2099569658722713726?s=20
编辑:Aeneas 大卫
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.