谷歌DeepMind被曝已经跑通RSI!三个大写字母点燃AI社区,Anthropic最害怕的东西来了

谷歌DeepMind被曝已经跑通RSI!三个大写字母点燃AI社区,Anthropic最害怕的东西来了

一条藏在推文里的大写字母密码,一张API中突然冒出的神秘模型名,一份90个月前就被忽略的官方博客,以及Sergey Brin在总部微厨房里的豪赌——所有线索都在指向同一个结论:谷歌DeepMind可能已经实现了RSI(递归自我改进)。

RSI,Recursive Self-Improvement(递归自我改进),被广泛认为是通往超级智能最关键的一步。AI自己改进训练方法、代码和模型,造出更强的下一代,再让下一代继续升级。一旦真正跑通,AI研发将进入自我加速循环。

两天前,Anthropic安全对齐负责人Hubinger说,未来十年AI灭绝人类的概率超过10%,而他真正害怕的,就是RSI。

两天后,谷歌DeepMind被曝跑通了RSI。

一封藏在推文里的密码

故事从9月12日开始。

一个名为lyra的匿名爆料账号给谷歌DeepMind官方账号发了一条看似普通的推文:”huge congRatulationS Indeed!”

如果仔细看,这句话里有三个异常大写的字母:R、S、I——正好拼成”RSI”。

随后,另一个账号Lentils贴出了一张疑似内部API调用结果截图。截图中出现了一个叫”rsi-model-liverl-le”的模型。他还声称,谷歌内部有10个同系列的训练模型槽位(虽然没贴出对应截图来证明)。

一张截图当然不构成”实锤”。但真正让它在一夜之间引爆AI社区的,不是截图本身,而是截图与一连串方向性信息之间严丝合缝的吻合。

API泄漏、博客纸条和微厨房

三天前,Business Insider独家报道了一个细节:Sergey Brin回归谷歌后的办公地点,是总部Gradient Canopy大楼里一间改造成的微厨房

路透社早在8月就报道过,Brin要求DeepMind加快Gemini研发,重点推动递归自我改进。

DeepMind今年6月发布的官方报告,也正式把”recursive improvement”列为AGI走向ASI的四条潜在路径之一。

再往前倒。9月2日,谷歌发布Gemini 3.8 Flash时,官方博客里有一段被绝大多数人忽略的话:”这些模型的进展,进一步被长时间运行的智能体循环所加速。这些循环被设计用来递归地评估和精炼底层模型。”

DeepMind的研究员姚顺宇随后评价:”对模型而言,这只是迈出了一小步;但对于RSI来说,这是一次巨大飞跃。”

另一个研究员Sicong Jiang更直接:”这就是RSI飞轮开始产生复利效应时的样子。更多的里程碑正在路上——推进更快,落地更强。”

翻译一下:谷歌DeepMind不仅在做RSI,而且已经看到了RSI的早期成果。

那个”rsi-model-liverl-le”是什么?

目前没有任何第三方验证这个模型的存在。截图可能是真的,也可能是恶作剧。

但1048576和65536这两个数字——截图中疑似出现的模型规格参数——与Gemini现有系列的规格完全一致。这要么是内部测试名,要么是精心设计的假截图。

更重要的是,如果截图是假的,那谷歌官方博客中那段关于”递归评估与精炼模型”的文字应该被撤回或解释。但谷歌至今没有回应。沉默本身,就是一个信号。

两天前的RSI警告,两天后的RSI”实锤”

两天前(9月11日),Anthropic的安全对齐负责人Hubinger在回复离职研究员Jacob Coxon的帖子时说,他真正害怕的是RSI——”AI参与研发更强AI,再由更强的AI加快AI研发”的自我加速闭环。

他的原话是:”未来十年内AI导致人类灭绝的概率超过10%。”

两天后,谷歌DeepMind被曝已经跑通了RSI。

这种戏剧性让我不知道该说”科技发展真快”还是”Hubinger的口头禅真的应验了”。

更微妙的是,同一时间,Anthropic创始人Dario Amodei呼吁整个AI圈踩刹车。OpenAI的Sam Altman和xAI的Elon Musk——这三位平时在AI路线上互相吵得不可开交的人——破天荒罕见地力挺。

不是因为他们突然和好了。是因为他们都看到了一个不想看到的信号。

我的判断:RSI已经发生,问题不是”如果”,而是”多快”

反思一下:Anthropic警告RSI→两天后DeepMind被曝跑通RSI。这不是巧合,而是因果。

当一家公司把RSI列为AGI通往ASI的四条路径之一,当它的联合创始人从微厨房里盯着团队推进RSI,当官方博客已经写下了”递归评估与精炼模型”,当一个带”rsi”名字的模型真的从API里跳出来时——再把它当”谣言”就不太诚实了。

RSI已经发生了。可能不是以人们想象中的那种”一次全自动迭代、一夜之间造出超级AI”的极端方式,而是以一种更渐进的方式——在Gemini 3.8 Flash的发布过程中跑通了第一轮RSI反馈循环

三个研究员说的话比任何截图都更有价值: – 姚顺宇:对模型而言只是一小步,对RSI是巨大飞跃 – Sicong Jiang:这就是RSI飞轮开始产生复利效应时的样子 – 谷歌官方博客:递归评估与精炼模型已经在加速

“复利效应”这四个字,对金融人来说是好消息,对AI安全的人来说是最可怕的噩梦。因为复利意味着加速——不是线性的,是指数级的。

Hubinger说的”未来十年”可能已经开始倒计时了。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注