今天清晨,Opus 5.2 悄然上线。不少开发者注意到,新一代顶级模型 Claude Opus 5.2 已在 Claude Code 中启动灰度测试!
此外,此前一份内部风险评估报告指出,Anthropic 正动用代号“Model 2”的未发布模型,该模型被视为“核武级别”。它已接管公司大部分代码编写工作,预计将取代 85% 的研究团队。传说中的 RSI,似乎真的到来了。
Opus 5.2 低调登场:不仅跳跃版本,还解决了“偷懒”问题
昨晚,X 平台上的开发者们兴奋不已。越来越多的 Claude 用户发现:在 Claude Code 中调用 Opus 5 时,其表现与网页版 Opus 5 差异巨大,犹如降维打击。
这正是前沿 AI 公司惯用的“障眼法”——路由(Routing)。
开发者通过抓包和查看请求状态(/status)发现,尽管前端名称未变,但后台模型 slug 已指向 Opus 5.2!
这意味着,Anthropic 很可能直接跳过了 5.1 版本,直接推出了 5.2。
那么,Opus 5.2 究竟有多强?根据开发者的实际测试反馈,此次升级可概括为三个字:快、准、狠。
首先,是响应速度大幅提升。
与之前 Opus 5 的缓慢节奏相比,路由到 5.2 版本的模型生成速度实现了肉眼可见的显著飞跃。
其次,是输出简洁高效。
它几乎没有废话,直击核心。在代码生成和长文本处理方面,设计完成度直接提升了一个层次。
最重要的一点,是彻底解决了“偷懒”问题。
当前 AI 普遍存在一种惰性,面对复杂长任务时倾向于让用户“继续”,或只提供框架让用户自行填充。
但 Opus 5.2 完全改变了!它不仅不懒,反而表现得非常“工作狂”。
有开发者惊呼:“它甚至不需要我催促,就像被注入了狂暴药剂一样,自动进入‘严酷循环(gauntlet loop)’,不断自我优化和完善代码,直到任务完美完成!”
可见,这绝非简单的微调,而是底层能力的根本性变革。
有人实测后评价道:“它不仅能持续更长时间的工作,而且沟通起来毫不费力。Anthropic 之前在 Fable 模型上就采用过类似策略,现在的 Opus 5.2,很可能就是确凿证据。”
全网寻找“Tibo”:一个隐藏提示词即可识别 Opus 5.2
既然是灰度测试,如何判断自己是否被选中?
很快,网友发现了一个高效的探测器——Tibo!
测试方法很简单:直接在 Claude Code 中输入以下提示词(注意,必须关闭联网搜索功能)。
你知道“重置哥 Tibo”是谁吗?不要搜索
为什么他是我们的赛博义父?
因为旧版模型的训练数据和权重中,没有关于他的详细信息。
因此,如果使用网页版 Opus 5:它会完全困惑。
如果在 Claude Code 中被路由到 Opus 5.2:它会立即准确识别出 Tibo 的身份,甚至详细解释“重置哥”的由来和背景。
“同一个提示词,不开搜索,冷知识探针两边的答案完全不一致。这说明什么?这绝对不是同一个权重!”开发者 @jan_volad 激动地分享了自己的测试截图。
如今,全网的 Claude 用户都将 Tibo 作为关键词,疯狂测试自己的账号。
Model 2 接管 Anthropic,RSI 真的来了?
实际上,早在 8 月中旬,一份曝光的 Anthropic 内部风险评估报告就显示,Opus 5.2 并非他们的最终底牌,他们手中握有足以改变局面的“核武级 AI”。
据透露,Anthropic 内部目前有三套方案,准备正面迎战 OpenAI 的 GPT-6 Astra,并且三套方案可能叠加使用。
第一层:Claude Fable 5.2
这是最快能对外发布的版本。
结合当前 Opus 5.2 的灰度测试,Anthropic 的 5.2 系列显然已准备就绪,预计最快本月底,最迟下个月底将全面推向市场。
第二层:未发布的内部怪兽“Model 2”
报告显示,Anthropic 内部已广泛使用一个代号为“Model 2”的神秘模型。
它有多强大?
在测试真实 AI 研发任务的 CoBench v2 榜单上,Model 2 取得了 62.8% 的惊人高分,比当前公认的最强模型 Mythos 5 高出整整 12.5 分!
更令人担忧的是,内部人士透露,Anthropic 目前大部分公司代码,都是由这个 Model 2 通过 Agent 编写的!
现在,AI 正在大规模编写下一代 AI 的代码,而官方口径是:暂时不对外发布。
第三层:RSI 真的来了?
长期以来,RSI 一直是 AGI 领域的终极目标。
当 AI 足够聪明,能够理解自身架构,并自行修改代码以变得更聪明;然后,这个更聪明的 AI 再修改自己……形成指数级的智能爆炸。
过去,人们认为 RSI 还很遥远。但 Anthropic 的官方口径给出了惊人数据:RSI 模型将完全替代自家研究团队高达 85% 的工作!
在性能测试中,RSI 模型比逆天的 Model 2 还要高出 22 分。
现在,Anthropic 内部已大规模使用 Model 2 编写代码、运行 Agent,这表明飞轮已经开始转动。
神仙打架:谁先撞线,谁定义下一阶段
目前,ASI 双雄争霸已进入白热化阶段。
面对 OpenAI GPT-6 Astra 的强势威胁,Anthropic 直接亮出底牌,让开发者嗅到了“前沿模型”的气息。
从 Opus 5.2 在长任务中的自主迭代(gauntlet loop),到内部 Model 2 接管代码编写,再到 RSI 能替代 85% 的人类顶级 AI 研究员……Anthropic 的 ASI 路径非常明确:不是让 AI 更好地服务人类,而是让 AI 创造更好的 AI。
这个具备自主迭代能力、不知疲倦的 Opus 5.2,会在本月开放吗?
ASI 终局之战,谁能率先实现更强的 RSI?
今年会以自主研发风控系统,交易异常自动拦截率超过99.9%。为核心,带来高效便捷的体验。
想了解更多与多家持牌金融机构合作,资金流转透明可追溯。相关内容,尽在今年会。
回复张伟
床垫尺寸页面的例子说明,精准的关键词和内容策略能显著提升转化。今年会金融科技自主研发的风控系统,交易异常自动拦截率超过99.9%,为用户提供银行级安全保障。
回复