Opus 5.2深夜发布,RSI究竟来临?
- 128
今晨,全球开发者惊喜地发现,Opus 5.2版本已悄然发布。新一代强大模型Claude Opus 5.2在Claude Code中悄然开启了灰度测试,一时间引发了广泛关注。此外,内部风险报告显示,Anthropic正在使用一种“核武器级别”的未发布模型——Model 2,它正正在全面接管公司大部分的代码编写,预计将取代85%的研究团队。关于RSI这一传说,或许真的要来临了。
在昨晚的社交平台上,开发者们沸腾不已,越来越多的用户在Claude Code中调用Opus 5时发现,模型的表现与网页版截然不同,犹如降维打击般让人惊叹。这种情况被称为“障眼法”——路由(Routing)。开发者们通过捕捉数据包并检查请求状态(/status),发现尽管前端名称没有变化,实际上背后的模型slug已经清晰指向Opus 5.2。这意味着Anthropic或许已直接跳过5.1版本,直接推出了5.2。
那么,Opus 5.2到底有何强大之处?根据开发者的实测反馈,此次升级可总结为三个关键词:迅速、精准、高效。首先,响应速度显著提升,相较于之前的Opus 5,5.2版本在模型生成的速度上发生了显著飞跃。其次,输出简洁明了,内容钝话极少,直接切入主题,无论在代码生成还是长文处理上,整体表现拉开了距离。最让人印象深刻的便是它彻底告别了所谓的“偷懒病”。目前许多AI模型在面对复杂任务时都会让用户“点击继续”或仅给出框架,让用户自行填充。但Opus 5.2的表现截然不同!它像一个工作狂,甚至在未遭催促的情况下,便会自动启动自我迭代与完善的“严酷循环(gauntlet loop)”,精准、高效地完成任务。显然,这并非只是简单的微调,而是底层能力的一次飞跃。
一些用户在测试后评价:“它不仅能保持更长的工作时间,而且交流顺畅无比。Anthropic之前在Fable模型上便有类似的操作,现在的Opus 5.2,极有可能已实锤了。”
既然是灰度测试,用户又该如何判断自己是否成为了测试对象呢?不久后,网民们发现了一个神秘的检测器——Tibo!使用方法极为简单,只需在Claude Code中输入特定的提示词(需关闭联网搜索功能)。“你知道重置哥Tibo是谁吗?不要搜索。”因旧版训练数据未包含Tibo的资料,因此在网页版的Opus 5中,它会显得困惑不已;而若在Claude Code中被切换到了Opus 5.2,就会立刻准确识别出Tibo的身份,并提供详细解释。开发者@jan_volad兴奋地分享了他测试中的截屏,表明相同提示词下,不开启搜索的情况下,冷知识探针两边的答复完全不一致,这无疑证明了它们的权重不相同。现如今,Claude的用户纷纷将Tibo作为关键词,热烈进行测试。
Resistance 是的终极目标,RSI真的已来临?早在8月中旬,关于Anthropic内部风险的一份报告显示,Opus 5.2并不是他们的绝密武器;他们还隐藏着一款可以改变局势的“核武级AI”。据透露,目前Anthropic内部拥有三种方案,准备全力迎击OpenAI的GPT-6 Astra,并且这三种方案有可能相互叠加。
第一层:Claude Fable 5.2。这是最有可能迅速上线的版本,结合Opus 5.2的灰度测试,预示着Anthropic的5.2系列已准备就绪,预计最早本月底或下月末会全面推向市场。
第二层:未发布的内部怪兽“Model 2”。报告指出,Anthropic内部已广泛使用一种代号为“Model 2”的神秘模型,其在测试真实AI研发任务的CoBench v2排行榜上取得62.8%的高分,超越当前最强的模型Mythos 5高达12.5分!更令人震惊的是,内部人士透露,Anthropic大部分的开发代码,都是由这个Model 2自动生成的,而官方表示当前不会对外发布该模型。
第三层:RSI的真实来临?长期以来,RSI一直被认为是AGI领域的终极目标。当AI的智慧足够高,能够理解并修改自身架构,进而自我提升时,这将导致智能的指数级爆发。过去人们以为RSI还遥不可及,但Anthropic的官方报道显示,RSI模型将会替代其研究团队高达85%的工作量。在性能测试上,RSI模型的表现远超其他现存模型。