RSI:当AI学会自我进化,强者真的会愈强吗?
RSI(递归自进化)是 2026 年硅谷最危险也最受关注的技术竞赛:Anthropic 披露第一方数据、OpenAI 给出明确时间表、国内开源阵营接连出手。但“强者愈强、不可逆”的叙事成立吗?本文拆解它的机制、争议与新公司的机会。
一、RSI,正在统治硅谷的议程
2026 年,一个话题正以前所未有的速度,从学术边缘走向产业中心——RSI。
它是 Recursive Self-Improvement(递归自进化) 的缩写,因为它关系到一个更大的事情:能不能让 AI 去发现 AI 自身的问题,然后把自己改得越来越强,并且这个循环能自我加速。
这件事之所以在 2026 年爆发,不是因为某一家公司,而是因为整个行业几乎同时押注了同一个方向:
- OpenAI 给出明确时间表——2026 年 9 月做出"AI 研究实习生",2028 年 3 月前实现真正自动化的"AI 研究员",据报道内部还建立了衡量这一进展的"RSI Index";
- Anthropic 6 月发布长文《When AI Builds Itself(当 AI 建造自己)》,副标题直白写着"我们在 RSI 方向上的进展与探索",并披露其 Claude 的 Agent 端到端独立完成了一项开放式 AI 安全研究,累计工作 800 小时,把一个 weak-to-strong(弱模型逼近强模型)的性能差距缩小了 97%(人类来做,一周只能缩小 23%);
- 学术界也正式入场——ICLR 2026 设立了"AI with Recursive Self-Improvement"专场 Workshop;
- 连媒体定调都换了说法,TechCrunch 一篇报道的标题直接是:"RSI is the new AGI"(RSI 是新的 AGI)。
当 OpenAI、Anthropic、顶会 Workshop、主流媒体和大把真金白银在同一时间指向同一个词,它就不再是"小众方向",而是已经形成共识。
而围绕 RSI,有一个极具诱惑力也十分危险的假设:率先达到自进化状态的公司,会把其他人越甩越远,而且不可逆。
这个推演成立吗?
二、RSI 的闭环:为什么"这一次"可能转得起来
先把概念讲清楚。
递归自进化的精髓是一个闭环:AI 发现 AI 模型的问题 → 优化 → 得到更强的 AI → 这个更强的 AI 又能发现更深的问题 → 再优化……"递归"指的就是这个循环不断向前推进。
这个想法本身并不新。它真正变得"可操作",是因为有两个条件在 2026 年同时成熟:
- Coding Agent(编程智能体)变强了——模型已经能自主写代码、跑实验、读结果;
- 模型对"自己"的认知突破了——强到可以用模型去充当研究员,让它去发现模型的弱点并优化。
但闭环能转起来的真正加速器,不是"AI 突然变聪明",而是反馈周期被压缩了几个数量级。
在传统科研中,导师提出方向、学生执行实验、再把"行不行、为什么不行"反馈回来——导师不直接碰实验,信息要经过"导师→学生→实验→学生→导师"的传递,一个循环至少几天,一个项目往往几周甚至几个月。
而有了足够强的 AI 之后:
你有个想法,告诉 AI,AI 很快把代码写出来、跑完告诉你结果。你写完之后出去喝个茶、开个会,结果就已经出来了。
也就是说,"想—做—看—改"的反馈周期从"天"缩短到了"分钟"级别。 当反馈快到这个程度,自我迭代就不再是线性爬坡,而可能进入加速状态。这是 RSI 区别于以往所有"用 AI 优化 AI"尝试的底层原因。
三、和 10 年前的 AutoML,到底有什么不同
熟悉 AI 历史的人会问:10 年前 Google 的 AutoML、神经架构搜索(NAS),不也是"用 AI 优化 AI"吗?
区别在于一句话:上一波没有一个模型能建模人类的高层知识。
上一代做法是研究员人工定义好搜索空间的大小和行为,让 AI 在这个空间里搜更好的解——AI 很笨,只能在人画好的圈子里打转。
这一波大模型不同之处在于,模型对 AI、对架构本身有了理解,这种理解可以部分替代"人类定义问题"的工作,于是搜索空间变得极大且智能。
换句话说:以前是"人深度参与定义每一个细节,AI 在小圈子里搜";现在要解决的难题是"怎么最大限度发挥 AI 的能力,让它自己找到解空间的结构"。人参与的多少变了,参与的层级也变了。
四、递归 ≠ 自动化:人还在 loop 里,只是层级更高
很多人把 RSI 等同于"把人从研究流程里彻底踢出去"。这是一种误读。
一个更准确的区分是:递归会先发生,完全自动化还远。
自动化程度取决于"人还做什么层级的工作"。低层级的执行被 AI 接管了,但更高一级的工作反而更需要人,对人的要求也更高——人省下了时间,却需要把更多脑力投入到更高层次的判断上。 人还在这个 loop 里面,只是这个 loop 的 level 更高一点。
这也是行业里很多人的看法,AI 目前仍替代不了顶尖的人类研究员。 递归循环可以转起来,但完全脱离人的"自动科学家",目前还看不到。
这个区分之所以重要,是因为它直接关系到下一个、也是最关键的问题——
五、核心争议:强者愈强,还是会进入另一个平台期?
这是整场 RSI 叙事里最危险、也最值得讨论的一个判断。
主流叙事认为强者愈强、不可逆,逻辑链很顺:最强的 Coding 能力 → 最先转起自进化飞轮 → 加速度越来越大 → 把所有人甩开,且无法追赶。
如果这个逻辑成立,那现在不是最强的公司,基本就"无缘决赛圈"了。这正是支撑当前估值和军备竞赛的核心故事。
但行业里也有不同看法,该看法认为,智能的提升不是渐进式的平滑曲线,而是"S 型曲线 + 平台期":
一开始涨很快,然后因为瓶颈停下来,进入一个平台期,直到下一个突破出现,再次出现 S 型曲线再上去……每个平台都应该对应一个突破。
这意味着:如果 RSI 是渐进式的(谁跑得快谁永远领先),OpenAI、Anthropic 既有最强的 Coding 能力、又有最多的算力,后来者没什么机会;但如果它是有平台期的、突破式的,那突破点不是靠堆算力就能拿到的——谁先撞上下一个"突破点",谁才真正跃迁。
这个分歧的本质,是对 Scaling Law(缩放定律) 的信仰分歧:
| 强 Scaling Law 信仰者 | 平台期 / 突破论 | |
|---|---|---|
| 曲线形态 | 平滑向上,堆算力就能持续变强 | S 型 + 平台期,需要突破性跃迁 |
| 资源观 | 算力/数据决定一切 | 十倍资源只换线性增长,且现实有上限 |
| 谁会赢 | 永远是最强的大厂 | 突破点不可预测,新公司有窗口 |
| RSI 路径 | Coding → RSI 是自然延伸 | RSI 需要 Scaling Law 之外的新创新 |
Anthropic 联合创始人 Jack Clark 的公开预测更细:2027 年底前 AI 研究完全自动化的概率约 30%,2028 年底前开始递归自我改进的概率约 60%+;他甚至把 2028 年底设成这条假说的**"证伪点"**——如果到那时还没发生,说明存在某种根本性约束。
而坚信 Scaling Law 的一方同样人多势众。
这场争论在 2026 年 8 月又多了几个新砝码。
怀疑的一方多了一个重量级声音:Google CEO 皮查伊在播客访谈里给 RSI 泼了盆冷水——"这是一个连续体,我们确实都在进步。但按大家描述 RSI 的方式,那代表下一个量级的加速……我们还没到那一步。"
加速的一方也有了新的论据:METR 的 Ajeya Cotra 把 AI 研究能力分成三级里程碑——"离了人类也能运转 → 与人类等价 → 超过人机协作",她的判断是:离第一级已经很近,而一旦到了第二级,一年内就可能冲到第三级。
而最值得玩味的信号,来自 Anthropic 自己的 8 月风险报告。报告结论是"按 RSP 标准,整体进度仍低于 RSI 阈值"(这个阈值定义为:AI 研发自动化使进度速率相对 AI 辅助前基线翻倍)。但报告罕见地补了一句:这个"未达标"的判断,信心比以往更低了——原因有两个:一是内部评测基准已"饱和"(比如 CoBench,模型要到 85% 才算"完全替代研究科学家/工程师",据社区流传,当前最强的内部模型只到 62.8%——已走完约 3/4,但最后一段最难);二是出现了"早期加速迹象"。
翻译一下:连最接近 RSI 的人,都在感慨不容易。 当"测不准"本身成为共识,"强者愈强"与"平台期"之争,就更加没有定论。
这场争论目前没有定论——但它恰恰是决定"谁有机会"的那个变量。
一句话:RSI 终局之争,本质是两种世界观之争——一种相信"堆就能赢",胜利属于算力最厚的巨头;一种相信"突破不可预测",胜利属于最先撞见下一个瓶颈的人。
六、已经发生的事:各家的第一份答卷
理论之外,看看实绩。RSI 不是只存在于报告里——在几个具体任务上,自进化的早期信号已经出现。
OpenAI:除了前述时间表和据报道的"RSI Index"评估体系,它的动作是"制度 + 组织 + 叙事"三件套。制度上,2025 年 4 月的 Preparedness Framework v2 已把"AI 自我改进能力"与生化、网络安全并列为三大成熟跟踪类别,Preparedness 团队正在专职招聘"RSI 安全研究员";组织上,据报道此前离开的翁荔(Lilian Weng)已回归,探索方向正是 RSI;叙事上,Sam Altman 在博客《The Gentle Singularity》里定调:"OpenAI 现在要做很多事,但首先,我们是一家超级智能研究公司。"
Anthropic:目前披露第一方数据最多的玩家。6 月报告给出的数字很直观:截至 2026 年 5 月,Anthropic 生产代码库中合并的代码超过 80% 由 Claude 编写,工程师人均日合并代码量是 2024 年的8 倍;模型能可靠完成的连续任务时长每约 4 个月翻一倍(2024 年 3 月还是 4 分钟级任务,2026 年已到 12 小时级,外推今年内进"天"级、明年进"周"级);最接近"自进化"的两项是——在"固定目标下把实验优化到最快"的任务里,Claude 一年内把加速比从 3 倍做到 52 倍(熟练人类研究员 4–8 小时只能到 4 倍);在 129 个"人类走弯路"的会话节点上,模型选出比人类更好下一步的比例从 51% 升到 64%。
8 月的风险报告再进一步:内部有一个未发布的 Model 2,比当前旗舰 Mythos 5"略强"(官方措辞是 somewhat more capable,并非代际跳变),无对外发布计划,但已被广泛用于 Anthropic 自身的编码、数据生成与研发——"Claude 现在编写了我们生产代码库中合并代码的绝大多数",6 月的 >80% 口径得到延续。
至于那个最亮眼的数字——800 小时把 weak-to-strong 性能差距缩小 97%(人类一周只能恢复 23%)——更多是"提效",是自进化的"第一层":把各种常规方法组合起来把分数顶上去。因为现阶段除了跑分,还没有别的办法衡量模型变强了多少,所以自进化的早期形态必然体现为提效、提速、降延迟。它真实,但还不是"递归跃迁"。
国内阵营:2026 年也突然热闹起来:
- 开源工程化——清华 + Frontis 的 OpenRSI(2026-08):把"AI 改进 AI"做成了可执行的工程。一个 35B 模型,在单张 RTX 4090(限 12GB 显存)、每个任务 12 小时的条件下,于 MLE 基准上超过 GPT-5.5 + Codex,逼近 GPT-5.6 和 2.8T 参数的 Kimi K3。它的核心设计是四个原子算子——Draft(起草)/ Improve(改进)/ Debug(修复)/ Crossover(重组),模型成为自己进化框架的"变异引擎"。值得单独点名的,是它难得的边界声明:作者明确说自己目前是 meta 自进化,处在"进化→自进化→元进化→RSI"阶梯的第三级,不声称通用 RSI 已解决。
- 数据层闭环——无尽前沿团队的 BigBang-V1(2026-08):号称"首个以递归自进化原生方式训练出的基座模型",后训练数据 100% 由 AI 自主合成,以可验证的前沿科学任务为核心。35B 总参数(激活约 3B 的 MoE),拿下全部 35B 模型中的 10 项第一,在 FrontierScience Research、PaperBench 等高难科研任务上超过 1T 级的 DeepSeek V4 Pro Preview。它的关键机制,是用"可验证性"给合成数据兜底、打破"合成数据坍缩"的魔咒——数据生产系统本身成为被优化的对象,人类角色被压缩到"定目标、定预算、划边界、做验收",AI 不能自行修改评测标准。
- 大厂:不挂名,但环节已日常化——DeepSeek 走算法效率路线(用更少一个数量级的钱正面刚推理任务),百度文心把"强化学习驱动模型自我优化"说成常规操作,腾讯的架构搜索实验里,AI 发现的架构在 1B 规模比 Llama3.2 高 2.4%。
学术侧:除了 ICLR 2026 的 RSI Workshop,已有一篇综述梳理了 2024–2026 年间约 1250 篇 arXiv 相关论文——一个方向只有在它"热到需要被系统综述"时,才算真正成型。
把这些放在一起看:在预训练优化、算子优化、speed run 这类"反馈快、可打分"的任务上,RSI 已经在发生;但离"AI 独立做出原创性理论突破"还有距离。 这正是下一节要讲的、RSI 真正的硬骨头。
七、RSI 最缺的不是算力,是"品味"
如果说 Coding 是 RSI 的"手",那它现在最缺的,是研究员的**"品味"**——对方向的感觉、对问题的抽象能力、以及从极少量样本里看到精准联系的洞察力。
这是大模型的结构性软肋。大模型之所以强,是因为有海量数据;对常见、重复的领域,它有学不完的样本。但科学家的世界是另一回事:每一次实验、每一次探索都会产生全新的问题,而这些新问题几乎没有现成数据。
一个典型例子是 grokking(模型突然"顿悟"的现象)和"涌现究竟如何产生"。从 2013、2014 年起,无数人用物理(重整化群、自旋玻璃)、数学(神经正切核)、贝叶斯、高斯过程等角度去解释,尝试了很多,但没有一个真正令人满意。要让 AI 去攻克这类"连人都没搞清、且没有数据集"的问题,难如登天。
但 RSI 的一个友好之处在于——它不像无人车那样"要么 0 要么 100",而是有很多台阶:
- 第一级:优化算法、提效提速——已经能用,有实际价值;
- 第二级:能挖出更深的东西,价值更大;
- 终极目标:让 AI 成为像爱因斯坦、牛顿那样的大脑,能用极少样本获得极深的知识。
最新的开源实践已经在给这条台阶画刻度:清华与 Frontis 的 OpenRSI 明确把自己定位在"进化→自进化→元进化→RSI"阶梯的第三级"元进化",并声明不声称通用 RSI 已解决——这种"逐级爬"的克制,与"一步登天"的叙事,正是 RSI 赛道最常见的分野。
即使终极目标遥遥无期,前面每一级台阶本身就有大量应用价值。这是 RSI 作为一条赛道"容错率高"的地方。
八、两个被低估的变量:安全与组织
安全:训练 AI 像训练狗。
很多人担心 AI 自我进化后会失控。一个有意思的现象是:越是 AI 领域之外的人越焦虑,领域之内的人反而不那么担心——因为从业者清楚,当下 AI 离"那一天"还有非常大的差距。
至于"失控"本身,有从业者打了一个比喻:现在训练 AI,"把它当成狗一样来训练",在这种进化压力下,AI 很难进化出与人类似的自我意识和自我认知。而且能力和欲求可以分离——很多天才数学家、物理学家在各自领域登峰造极,却与世无争、不慕权力。
安全议题在 2026 年夏天还出现了一个值得注意的姿态变化:Anthropic 6 月报告首次明确表态——"如果能有效放慢这项技术的发展以换取应对时间,那很可能是件好事",但前提是建立可验证的全球协同减速/暂停机制(它自己类比《中导条约》式的核查,同时承认这比核军控更难:训练比导弹发射井更隐蔽、投入物是通用品、偷偷背叛的激励巨大)。一个被看作"竞速者"的公司,开始公开讨论"怎么一起慢下来",这本身就是 2026 年的一个信号。当然,这套对策也是把双刃剑——如果减速只是让最不谨慎的玩家偷偷追上,所有人反而更不安全。
组织:为什么大厂反而跑不动。
这一波 AI 在某种意义上是"反大厂"的。一旦组织里形成"导师—学生""管理者—执行者"的两级架构,信息传递变慢,最接近实验的人不掌握方向、掌握方向的人不碰实验,速度就垮了——又掉回那个"以天为周期"的低速 loop。
当组织逐渐变得庞大,超过150 人临界点("邓巴数"):人不再互相认识,只能靠组织架构和汇报线传递信息。这也是为什么 OpenAI、Anthropic 虽然人多,但真正做模型的核心团队保持精简。
这个判断如果成立,意味着:RSI 这场比赛,组织效率可能和算力一样重要。 一个精干的小团队,未必跑不过臃肿的大厂。
九、你该相信哪种未来
把整件事拉远来看。
RSI 最危险的诱惑,是"强者愈强、不可逆"的叙事。它逻辑自洽、便于融资,也正在成为行业默认假设。但至少存在一个被多位从业者(不止田渊栋)反复指出的漏洞:智能提升可能是台阶式的、有平台期的,而平台期的突破,靠的不是更多的算力,而是新的原理。
如果是这样,那这场比赛的关键就不是"谁现在最强",而是"谁先撞上下一个牛顿时刻"——无论他来自万人巨头,还是不到 30 人的小团队。
这正是 2026 年这场竞赛最迷人的地方:它把一个巨大的不确定性,摆在了所有人面前。
- 你可以相信"堆就能赢",那未来的牌几乎都捏在几家巨头手里;
- 你也可以相信"突破不可预测",那未来就还存在被意料之外的人改写的可能。
澎湃/雷科技一篇报道的收尾值得一读:预训练带来"参数崇拜",RLHF 让人相信"价值观可以微调",而 RSI 在讲"机器自己跑完研发链条"的故事——每一步都在让人类退出决策链条,而且这种退出是不可逆的。
RSI 不是某一个公司的故事,它是 AI 发展到这一步必然要面对的下一道闸门:当模型强到可以审视、修改自己,进化的主导权,会不会第一次从人类手中滑落?
这个问题没有标准答案。但正因为没有,它才值得我们认真对待。
参考资料
- 《晚点聊 LateTalk》第 178 期:与田渊栋聊 RSI(小宇宙 / 苹果 Podcast)
- Anthropic:《When AI Builds Itself》(2026-06)、《Redacted Risk Report — August 2026》(2026-07)
- OpenAI:Preparedness Framework v2(2025-04);Sam Altman:《The Gentle Singularity》
- Recursive Superintelligence:《First Steps Toward Automated AI Research》(2026-06-11)
- ICLR 2026 Workshop:AI with Recursive Self-Improvement
- TechCrunch:《RSI is the new AGI — and it's just as hard to pin down》(2026-05-28)
- OpenRSI:FrontisAI/OpenRSI(GitHub / arXiv 2607.28568);BigBang-V1:endless-frontier/BigBang-V1(Hugging Face)
本文为多源公开资料的综合解读,观点与预测归原作者所有;不构成投资或研究建议。
📌 相关文章
Anthropic的Agent决策清单:4个问题判断该不该做Agent
2026 年 5 月,Anthropic 的一场内部分享流出,PPT 上有一张超干货的决策清单:"Should I build an agent" Checklist。 我看完第一反应:这张图,能帮 90% 的 AI 创业者少走半年弯路。
DeepSeek成大模型斩杀线
DeepSeek 把模型价格压到很低,OpenAI 和 Anthropic 就会被斩杀吗?答案没有那么简单。 DeepSeek 把“斩杀线”变成了一个行业话题。 最近,“大模型斩杀线”成了一个很响的说法。
Graph Engineering 又火了:AI Agent 终于开始设计「协作关系」
图源:The AI Operator,Eugeniu Ghelbur。 这两周的 Agent 圈,有一种很熟悉的速度。
评论 (无需注册,匿名即可)
还没有评论,来抢沙发~