谷歌似乎跑通了RSI。一个名为「rsi-model-liverl-le」的模型突然出现在Google生成式语言API的返回结果里。这个模型正是递归自我改进(Recursive Self-Improvement,简称RSI)。

谣言迅速传播,称谷歌DeepMind已经实现了RSI。网友Chubby还在推测之际,Anthropic CEO公开宣布全行业包括Anthropic,RSI已经开始发生。这让Chubby相信传言是真的:RSI已经被实现了。据称,Google内部不止这一个模型,在同一批标签下还有从00到09编号的10个专属训练槽位。当晚,Google紧急收回了一批相关API密钥,但之后没有进一步的官方声明。

这起风波始于一句看似普通的祝贺。9月11日晚,爆料账号lyra给Google DeepMind发了一条帖子,内容中三个大写字母拼成RSI。这条帖子迅速引发热议,几个小时后,另一个账号Lentils直接发布了实锤截图。截图显示,Google的API返回了一段JSON代码,模型代码为「rsi-model-liverl-le」,参数规格是输入上限1048576个token,输出上限65536个token。Lentils指出,如果GDM内部真有这样一个模型,并且还有10个专属的训练槽位,那确实非常惊人。

LiveRL被认为是在线强化学习,即模型一边运行业务,一边自我进化。接下来,lyra发文@了Google AI Studio负责人Logan Kilpatrick,称没有必要因为怕他而收回API密钥。他还透露这批密钥来自GDM内部员工,可以访问超过1000个内部checkpoint。Lentils紧随其后嘲讽道,“我闻到了恐惧的味道。”