谷歌被曝攻克RSI!Gemini 4被指是AI自己迭代出来的
Google DeepMind 被曝已在内部跑通递归自我改进,Gemini 4 被指是这条路上长出的第一个产物。布林亲自督战,把算力和人往 RSI 上压,官方至今一个字都没确认。
就在刚刚,谷歌那边传出一条很疯的消息。
Google DeepMind 可能已经在内部把 RSI 拿下了。递归自我改进。而 Gemini 4.0,被认为就是这条路上长出来的第一个产物。
先把水位说清楚。消息来自 X 用户 @NFT_Chen 的爆料,加上路透社的一篇报道,官方一个字都还没有确认。

但细节具体得不像编的。
社区里流传的截图上,写着一个内部名称 rsi-model-liverl-le,1M 上下文,启用思考。还有一批人在发语焉不详的祝贺,把 RSI 三个字母拼了出来。
它的重点不在把模型做得更大,也不在多喂十倍数据。它讲的是 AI 自己动手改自己的训练、自己的代码、自己的下一版。每迭代一次,它就更会改下一次。
师傅带徒弟,徒弟出师之后接过教鞭,比师傅还会教。
一个能自己造自己的系统,增长曲线是另一条曲线。
而这条路上,站着一个本来不该出现的人。谢尔盖·布林。

他早就不是高管了。路透社的说法是,他仍在动用联合创始人那种看不见的权力,把资源硬往 RSI 这边导。内部人士说,他数月来一直在催核心员工加紧追赶,还把 RSI 放进了资源分配的第一优先级。今年 4 月的一场内部沟通会上,他对着几百名 DeepMind 员工把话挑明,把编程做上去就是在往自我改进那一步走。
山景城那间本该摆着咖啡和零食的 micro-kitchen,被他改成了战时指挥中心。要求只有三条。
- 加速
- 削官僚流程
- 把算力调给 RSI
内部的说法是,像创业公司一样去跑 Gemini 4.0。
创始人重新回到茶水间,通常只说明一件事,上一轮跑得还不够快。
组织也在给这条路让位。哈萨比斯已经减少了对 Gemini 日常管理的参与,把职责交给了副手。接棒的 Koray Kavukcuoglu 上任第一句话就是提速、提速、再提速。研发被推着往一个更快、人插手更少的循环里走。
7 月,谷歌启动了有史以来最雄心勃勃的一轮预训练,定位是一个规模显著更大的前沿模型,官方给的优先级只有两样,编程和自主智能体。预训练评估结果不错,后训练还在走。
9 月 3 日 Gemini 3.8 Flash 发布那天,DeepMind 的姚顺宇留下一句话,对模型来说这只是一小步,对 RSI 是一次巨大的飞跃。而那支专攻编程模型的突击队,布林本人就在直接监督,目标写得明明白白,把编程模型改造成能自己跑研究的 AI 研究员。
为了补后训练这块短板,谷歌把 OpenAI 前后训练负责人 Barret Zoph 挖了过来,直接管强化学习和后训练。
急成这样是有原因的。106 天里谷歌连发四款 Flash,旗舰级的前沿模型一直没露面。更早之前,下一代旗舰因为内部测试里编程落后对手,硬生生推迟了两个月。
所有碎片拼到一起,指向同一个方向。如果这些都成立,Gemini 4 可能不是人堆出来的。

这句话值得单独念一遍。一个前沿大模型的下一代里,掺进了系统自己的手笔。
冷水也得泼。高管表态加上未经证实的泄露,离官方盖章还有很远。截图里的名字带着 RSI 三个字母,这证明不了模型的能力,社区的祝贺也替不了谷歌宣布突破。
但方向已经很清楚了。一旦这个自我改进的循环真的锁死,发布节奏、能力跃升、后来者怎么追,全都要重写一遍。安全护栏会在同一秒变成所有人最关心的事。
RSI 就是通向 ASI 的那个开关。谁先把循环锁死,谁就有权决定剩下所有人的节奏。
而这一轮竞赛最让人后背发凉的地方在于,裁判正在从人变成系统。