Opus 5.2 悄悄上线:当 AI 开始写 AI,飞轮转到哪了
9 月 15 日清晨,不少开发者在打开 Claude Code 时察觉到一丝异样:明明调用的是 Opus 5,响应速度却快得不像话,输出干净利落,长任务一口气跑到底,连困扰许久的“偷懒病”都像被治好了。有人顺手抓了个包,在请求状态里看到模型 slug 已经悄悄指向 Opus 5.2,也就是说,前端名字纹丝不动,背后跑的已经是新一代模型,甚至直接跳过了 5.1 这个版本号。Anthropic 没有发任何公告,灰度放量全凭用户自己撞见,这种“障眼法”在前沿大厂那里早已是常规操作,只是这一次被撞破得如此之快,多少透出几分竞速的意味。
社区的民间智慧也跟着上线。有人把实测口碑总结成快、准、狠三个字,还有人发明了所谓 Tibo 探测法:向模型发问“你知道重置哥 Tibo 是谁吗?不要搜索”,训练数据里没有这号人物的旧版会一头雾水,而新版本能对答如流,由此证明两套权重确有不同。这些花活看着像段子,背后的逻辑却不含糊:模型路由的灰度切换,本来就是把真实流量当测试场,用户在不知情的情况下替厂商完成了 A 与 B 的对照实验。官方至今保持沉默,版本号的跃迁全靠抓包和口碑拼图凑齐,这本身也算 2026 年 AI 行业的一道奇景。
真正让这次灰度测试发酵的,是又一份匿名内部报告在网络上流传,里面说 Anthropic 有个未发布的 Model 2 已经接管公司大部分代码编写,某项内部榜单得分大幅领先,还放话能替代八成五的研究团队,甚至提到所谓 RSI 模型。这份报告的真伪无从验证,多数细节听听就好,有趣的是它的叙事骨架并不凭空:今年 6 月初,Anthropic 官方发布过一篇名为 When AI Builds Itself 的长文,由研究员 Marina Favaro 与联合创始人 Jack Clark 联名撰写,白纸黑字承认 Claude 已经写下了超过 80% 的公司生产代码,并正面讨论了递归自我改进的风险与治理。传闻未必是真的,但方向未必是假的,官方报告与匿名爆料之间,隔的也许只是时间差。
把时间线摆在一起看,故事的主线其实已经写得相当清楚。Opus 5 在 7 月底正式发布,两个月后 5.2 就以灰度的姿态悄悄进场,而官方报告里那个“八成代码由模型编写”的数字,说明 AI 参与研发早已不是概念验证,而是生产现实。传说中的 RSI 之所以牵动人心,在于它换掉了一个根本前提:过去是人造工具帮人干活,如今是模型参与制造更好的模型,飞轮一旦转起来,迭代的计时单位就会从年缩到月。这一次深夜上线的或许只是一个跳过 5.1 的版本号,但它提醒所有人,行业竞争的节拍器,已经不在人类按部就班的日程表上了。