OpenAI 与 Anthropic 近期频繁提及的 RSI(递归自我改进),正从概念走向部分现实。Anthropic 披露,截至 2026 年 5 月,其生产代码库中超过 80% 由 Claude 编写;OpenAI 也承认早期模型曾参与自身创造。但三位 AI 研究者在播客中指出,当前只实现了以三个月为周期的慢速 RSI,距离无需人类介入的快速起飞仍有明显差距。核心瓶颈在于:越接近能力前沿,有效训练信号越稀缺,下一阶段训练环境越难构造;模型在判断力、思路多样性和长期品味上仍弱于人类。讨论还区分了累积型任务与非平稳分布任务,认为 RSI 或许比当好律师助理更容易,但真正的跃迁可能需要抛弃现有范式。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅