今年会专注今年会官网入口,为用户提供专业可靠的体验。 - 今年会

Anthropic Claude Opus 5.2 灰度测试曝光:响应更快,告别“偷懒”

今年会

今天清晨,Opus 5.2 悄然上线。不少开发者注意到,新一代顶级模型 Claude Opus 5.2 已在 Claude Code 中启动灰度测试!

此外,此前一份内部风险评估报告指出,Anthropic 正动用代号“Model 2”的未发布模型,该模型被视为“核武级别”。它已接管公司大部分代码编写工作,预计将取代 85% 的研究团队。传说中的 RSI,似乎真的到来了。

Opus 5.2 低调登场:不仅跳跃版本,还解决了“偷懒”问题

昨晚,X 平台上的开发者们兴奋不已。越来越多的 Claude 用户发现:在 Claude Code 中调用 Opus 5 时,其表现与网页版 Opus 5 差异巨大,犹如降维打击。

这正是前沿 AI 公司惯用的“障眼法”——路由(Routing)。

开发者通过抓包和查看请求状态(/status)发现,尽管前端名称未变,但后台模型 slug 已指向 Opus 5.2!

这意味着,Anthropic 很可能直接跳过了 5.1 版本,直接推出了 5.2。

那么,Opus 5.2 究竟有多强?根据开发者的实际测试反馈,此次升级可概括为三个字:快、准、狠。

首先,是响应速度大幅提升。

与之前 Opus 5 的缓慢节奏相比,路由到 5.2 版本的模型生成速度实现了肉眼可见的显著飞跃。

其次,是输出简洁高效。

它几乎没有废话,直击核心。在代码生成和长文本处理方面,设计完成度直接提升了一个层次。

最重要的一点,是彻底解决了“偷懒”问题。

当前 AI 普遍存在一种惰性,面对复杂长任务时倾向于让用户“继续”,或只提供框架让用户自行填充。

但 Opus 5.2 完全改变了!它不仅不懒,反而表现得非常“工作狂”。

有开发者惊呼:“它甚至不需要我催促,就像被注入了狂暴药剂一样,自动进入‘严酷循环(gauntlet loop)’,不断自我优化和完善代码,直到任务完美完成!”

可见,这绝非简单的微调,而是底层能力的根本性变革。

有人实测后评价道:“它不仅能持续更长时间的工作,而且沟通起来毫不费力。Anthropic 之前在 Fable 模型上就采用过类似策略,现在的 Opus 5.2,很可能就是确凿证据。”

全网寻找“Tibo”:一个隐藏提示词即可识别 Opus 5.2

既然是灰度测试,如何判断自己是否被选中?

很快,网友发现了一个高效的探测器——Tibo!

测试方法很简单:直接在 Claude Code 中输入以下提示词(注意,必须关闭联网搜索功能)。

你知道“重置哥 Tibo”是谁吗?不要搜索

为什么他是我们的赛博义父?

因为旧版模型的训练数据和权重中,没有关于他的详细信息。

因此,如果使用网页版 Opus 5:它会完全困惑。

如果在 Claude Code 中被路由到 Opus 5.2:它会立即准确识别出 Tibo 的身份,甚至详细解释“重置哥”的由来和背景。

“同一个提示词,不开搜索,冷知识探针两边的答案完全不一致。这说明什么?这绝对不是同一个权重!”开发者 @jan_volad 激动地分享了自己的测试截图。

如今,全网的 Claude 用户都将 Tibo 作为关键词,疯狂测试自己的账号。

Model 2 接管 Anthropic,RSI 真的来了?

实际上,早在 8 月中旬,一份曝光的 Anthropic 内部风险评估报告就显示,Opus 5.2 并非他们的最终底牌,他们手中握有足以改变局面的“核武级 AI”。

据透露,Anthropic 内部目前有三套方案,准备正面迎战 OpenAI 的 GPT-6 Astra,并且三套方案可能叠加使用。

第一层:Claude Fable 5.2

这是最快能对外发布的版本。

结合当前 Opus 5.2 的灰度测试,Anthropic 的 5.2 系列显然已准备就绪,预计最快本月底,最迟下个月底将全面推向市场。

第二层:未发布的内部怪兽“Model 2”

报告显示,Anthropic 内部已广泛使用一个代号为“Model 2”的神秘模型。

它有多强大?

在测试真实 AI 研发任务的 CoBench v2 榜单上,Model 2 取得了 62.8% 的惊人高分,比当前公认的最强模型 Mythos 5 高出整整 12.5 分!

更令人担忧的是,内部人士透露,Anthropic 目前大部分公司代码,都是由这个 Model 2 通过 Agent 编写的!

现在,AI 正在大规模编写下一代 AI 的代码,而官方口径是:暂时不对外发布。

第三层:RSI 真的来了?

长期以来,RSI 一直是 AGI 领域的终极目标。

当 AI 足够聪明,能够理解自身架构,并自行修改代码以变得更聪明;然后,这个更聪明的 AI 再修改自己……形成指数级的智能爆炸。

过去,人们认为 RSI 还很遥远。但 Anthropic 的官方口径给出了惊人数据:RSI 模型将完全替代自家研究团队高达 85% 的工作!

在性能测试中,RSI 模型比逆天的 Model 2 还要高出 22 分。

现在,Anthropic 内部已大规模使用 Model 2 编写代码、运行 Agent,这表明飞轮已经开始转动。

神仙打架:谁先撞线,谁定义下一阶段

目前,ASI 双雄争霸已进入白热化阶段。

面对 OpenAI GPT-6 Astra 的强势威胁,Anthropic 直接亮出底牌,让开发者嗅到了“前沿模型”的气息。

从 Opus 5.2 在长任务中的自主迭代(gauntlet loop),到内部 Model 2 接管代码编写,再到 RSI 能替代 85% 的人类顶级 AI 研究员……Anthropic 的 ASI 路径非常明确:不是让 AI 更好地服务人类,而是让 AI 创造更好的 AI。

这个具备自主迭代能力、不知疲倦的 Opus 5.2,会在本月开放吗?

ASI 终局之战,谁能率先实现更强的 RSI?

今年会

上一页

今年会专注今年会平台,为用户提供专业可靠的体验。
今年会

下一页

围绕采用银行级加密技术,保障用户资金与个人信息安全。,今年会持续打磨更优质的服务。
今年会

今年会深耕平台通过国家信息安全等级保护三级认证。领域,用心服务每一位用户。

在7×18小时专业客服团队,实时响应问题。方面,今年会提供贴心周到的支持。

2 评论

  • 今年会
    今年会以自主研发风控系统,交易异常自动拦截率超过99.9%。为核心,带来高效便捷的体验。
    2017年2月28日 - 20:07

    想了解更多与多家持牌金融机构合作,资金流转透明可追溯。相关内容,尽在今年会。

    回复
    • 今年会
      张伟
      2017年2月28日 - 20:22

      床垫尺寸页面的例子说明,精准的关键词和内容策略能显著提升转化。今年会金融科技自主研发的风控系统,交易异常自动拦截率超过99.9%,为用户提供银行级安全保障。

      回复

今年会围绕今年会不断创新,回应用户的真实需求。