ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

新一代神级模型 Claude Opus 5.2,已经在 Claude Code 中开启灰度测试!

新一代神级模型 Claude Opus 5.2,已经在 Claude Code 中开启灰度测试! 今天清晨Opus 5.2 悄悄上线了。许多开发者发现新一代神级模型 Claude Opus 5.2已经在 Claude Code 中开启灰度测试而且此前一份内部风险报告显示Anthropic 正在动用「核武器级别」的未发布模型 Model 2。它接管了公司大部分代码编写将替代 85% 研究团队。传说中的 RSI真的来了。Opus 5.2 悄悄上线不仅跳级还治好了「偷懒病」昨晚X 上的开发者们沸腾了。越来越多的Claude用户发现在Claude Code中调用Opus 5时它的表现和网页版Opus 5截然不同仿佛降维打击。这就是前沿AI大厂最喜欢玩的「障眼法」——路由Routing。开发者们通过抓包和查看请求状态/status发现虽然前端名字没变但背后的模型slug已经赫然指向了Opus 5.2也就是说Anthropic大概率直接跳过了5.1版本直接端出了5.2。所以Opus 5.2到底多强根据开发者实测反馈这次的升级可以总结为三个字快、准、狠。首先是响应速度狂飙。相比于之前Opus 5的慢条斯理路由到5.2版本的模型生成速度有了肉眼可见的质的飞跃。第二点是输出干净利落。它的废话极少直切要害。在代码生成和长文本处理上设计完成度直接拉开了一个档次。最重要的就是彻底告别了「偷懒病」了。现在的AI普遍有一种懒惰感遇到复杂长任务喜欢让你「按继续」或者只给你一个框架让你自己填。但Opus 5.2彻底变了 它不仅不懒还非常「工作狂」。有开发者惊呼「它甚至不需要我催促就开始像被喂了狂暴药水一样自动进行『严酷循环gauntlet loop』不断自我迭代和完善代码直到任务完美结束」可以看出这绝对不是简单的微调而是底层能力的蜕变。有人实测后这样评价「它不仅能坚持更长的工作时间而且沟通起来毫不费力。Anthropic之前在Fable模型上就玩过这一手现在的Opus 5.2很可能是实锤了。」全网找「Tibo」一个隐藏提示词测出Opus 5.2既然是灰度测试怎么知道自己有没有被选中很快网友们就发现一个神级探测器——Tibo测试方法非常简单直接在Claude Code 中输入以下提示词注意必须关闭联网搜索功能。你知道「重置哥 Tibo」是谁吗不要搜索为啥是我们的赛博义父因为旧版的训练数据和权重里根本没有他的详细信息。因此如果你用的是网页版的 Opus 5 它会一脸懵逼。如果你在 Claude Code 中被路由到了 Opus 5.2 它会立刻精准识别出Tibo的身份甚至给你详细解释「重置哥」的由来和背景。「同一个提示词不开搜索冷知识探针两边的答案完全不一致。这说明什么这绝对不是同一个权重」开发者 jan_volad 激动地分享了自己的测试截图。现在全网的Claude用户都把Tibo当成关键词疯狂测试自己的账号。Model 2接管AnthropicRSI真来了其实早在8月中旬一份曝光的Anthropic 内部风险报告就显示Opus 5.2 根本不是他们的底牌他们手里握着的是足以改变局势的「核武级AI」。据透露Anthropic 内部目前有三套方案准备正面硬刚 OpenAI的GPT-6 Astra而且三套方案有可能叠加。第一层Claude Fable 5.2这是最快能对外落地的版本。结合目前 Opus 5.2 的灰度测试Anthropic 的 5.2 家族显然已经整装待发预计最快本月底最迟下个月底就会全面推向市场。第二层未发布的内部怪兽「Model 2」报告显示Anthropic 内部已经广泛使用一个代号为「Model 2」的神秘模型。它有多强在测试真实AI研发任务的 CoBench v2 榜单上Model 2 打出了 62.8% 的恐怖高分比当前公认的最强模型 Mythos 5 还要高出整整 12.5 分更可怕的是内部人士透露Anthropic 如今大部分的公司代码都是由这个Model 2跑Agent写出来的现在AI 正在大规模编写下一代 AI 的代码而官方的口径是暂时不对外发布。第三层RSI真来了一直以来RSI都是AGI领域的终极圣杯。当AI 变得足够聪明可以理解自身的架构然后自己动手修改自己的代码让自己变得更聪明接着这个更聪明的AI再修改自己……形成指数级的智能爆炸。以前人们会觉得RSI还很远。但 Anthropic 的官方口径却给出惊人数据RSI 模型将完全替代自家研究团队的高达 85% 的工作在性能测试上RSI模型比逆天的Model 2还要再高出 22 分。现在Anthropic内部已经在大规模用 Model 2 写代码、跑 Agent这说明飞轮已经转起来了。神仙打架谁先撞线谁定义下一阶段现在ASI双雄争霸已经白热化。面对OpenAI GPT-6 Astra的强势威胁Anthropic直接开大让开发者闻到了「前沿模型」的味道。从 Opus 5.2 在长任务中的自主迭代gauntlet loop到内部 Model 2 接管代码编写再到 RSI 能够替代 85% 的人类顶级AI研究员……Anthropic的ASI路径非常清晰不是让 AI 更好地服务人类而是让 AI 创造更好的 AI。这个拥有自主迭代能力、不知疲倦的 Opus 5.2会在本月开放吗ASI终局之战谁能率先实现更强的RSI
返回列表