ARTICLE SIGNAL
谷歌DeepMind破解RSI?揭秘AI自我进化的最新资讯
谷歌DeepMind,破解RSI,递归自我改进,AI自我进化,大模型,AGI,LLM,AI资讯,AI新闻,AI门户,探讨Google是否通过rsi-model实现自主训练,解析Gemini迭代速度背后的秘密。
type
status
date
slug
summary
tags
category
icon
password
网址
近期,整个人工智能圈子被一则极具爆炸性的传闻点燃:“谷歌跑通RSI了?!”
一个名为“rsi-model-liverl-le”的神秘模型突然出现在Google生成式语言API的返回结果中。这里的RSI,指的正是AI领域多年来梦寐以求的圣杯——递归自我改进(Recursive Self-Improvement)。如果传言属实,这意味着大模型已经跨越了单纯依赖人类投喂数据和调整参数的阶段,开始实现自主编写代码、自我评估和自我进化。在这场通往AGI(通用人工智能)的狂飙突进中,掌握第一手AI资讯和AI新闻变得前所未有地重要。本文将带您深入解读这起风波背后的技术真相,以及它对整个AI行业的深远影响。
传言与实锤:神秘模型现身API
这起引发全网热议的风波,源于社交媒体上一句看似普通的祝贺帖。爆料者向Google DeepMind发送了一条包含藏头诗的推文,将“RSI”三个大写字母巧妙地嵌入其中。随后,更多实锤证据浮出水面。
有开发者公开了Google API返回的一段JSON代码截图,赫然显示着模型代码为“rsi-model-liverl-le”,显示名称为“RSI Model LiveRL LE”。其参数规格(输入上限1048576个token,输出上限65536个token)与目前Gemini系列的顶级规格严丝合缝。更令人震惊的是,据爆料称,Google内部不仅运行着这一个模型,还挂着从00到09编号的10个专属训练槽位。
这里的“LiveRL”被业界普遍解读为“在线强化学习(Live Reinforcement Learning)”,即模型在处理实际业务的同时,一边收集反馈一边进行自我进化。面对这些泄露,Google官方的反应极为迅速,当晚紧急收回了一批相关API密钥,但这反而让更多人相信,这绝不仅仅是一个内部恶作剧。
高层豪赌:Sergey Brin全面押注自我进化
要理解Google为何在RSI上如此激进,我们需要将目光转向其内部的高层动向。据最新AI新闻报道,谷歌联合创始人Sergey Brin对目前Gemini的进展速度感到不满,并亲自下场督战,力促团队将核心资源全面向递归自我改进倾斜。
Brin的办公地点甚至搬到了总部大楼里一间改造过的微厨房。他坐镇于此,不仅直接插手芯片算力的分配,为Gemini团队开辟“算力特权通道”,还推行了激进的内部计划,用真实数据训练Gemini的代码能力。一位前员工直言,Brin已经被“AGI洗脑”,他深信RSI是谷歌实现弯道超车的唯一路径。
在过去的一年里,面对openai(尤其是chatGPT的持续火爆)以及claude等强劲对手的步步紧逼,Google在大模型竞赛中一度显得有些被动。核心人才的流失和新一代旗舰模型因编码能力不达标而推迟发布,都让Google倍感压力。因此,全面押注RSI,将动辄按季度计算的迭代周期暴力压缩到按周计算,成为了Google的终极反击战。
恐怖的迭代节奏:Gemini背后的复利飞轮
其实,Google对于RSI的探索早就摆在了明面上,只是许多人并未察觉。回顾近期Gemini Flash版本的发布节奏,简直令人胆寒:三周一个版本,六周内实现了三个大跨度的跃升。
在官方博客中,Google曾隐晦地提到:“这些模型的进展,进一步被长时间运行的智能体循环所加速。这些循环被设计用来递归地评估和精炼底层模型。”这实际上就是RSI飞轮开始运转的明确信号。传统的大模型训练流程是“人训、人评、人再训”,一个周期起步就是一个季度。而现在,通过AI自主生成提示词(Prompt)、自主跑实验,迭代速度已经远远超出了人类的极限。
这种速度意味着,模型强不强已经变成了一个中间变量。只要循环转得足够快,模型每转一圈就会自动刷新一次能力上限。这就是RSI飞轮产生复利效应时的恐怖威力。
行业巨变的临界点:从大模型之争到循环之争
RSI这个概念在人工智能圈流传了二十多年,如今终于从纸上谈兵走向了现实落地。不仅是Google,整个行业都在向这个终点狂奔。
Anthropic的CEO近期公开宣布,RSI已经在全行业(包括Anthropic内部)开始发生。而OpenAI也曾表示,其内部模型已经能协助后训练更小的模型,为研究员节省了大量时间。从LLM(大型语言模型)到真正的超级智能,AI自主编写核心代码、自主跑完训练循环已经成为必经之路。
未来的AI竞赛,比拼的将不再仅仅是谁的参数量大、谁的底层架构好,而是谁的“自我进化循环”转得最快。人类研究员在这个循环中的角色正在逐渐后退,最终可能只剩下设定目标和按下确认键。
结语与展望
如果那张API截图是真的,那么AI研发史上第一个由模型自己训练出来的模型,已经在Google的机房里日夜不休地运转了。真正的验证点即将到来:如果接下来的几周内,Gemini的新版本依然能保持这种不可思议的迭代速度准时发布,那么RSI就不再是传言,而是已经降临的现实。
在这个AI技术日新月异、AI变现模式层出不穷的时代,保持对前沿动态的敏锐嗅觉至关重要。获取更多深度的AI资讯、最新AI日报以及实用的AI工具教程,欢迎访问我们的AI门户网站:https://aigc.bar。在这里,与我们一起见证AGI时代的全面到来。
Loading...