上海AILab 上交 清华 字节团队发布论文《The Last AI Built by Humans》(75页)
💥震惊:人类可能正在造最后一代亲手打造的AI,终极RSI路线图来了!结论比标题更狠!
最新上交+清华+字节+上海AI Lab等团队75页论文 《The Last AI Built by Humans》 把RSI从口号拉回可检验路线图,核心结论就这几条:
1️⃣ 真正的RSI不是“会改自己代码” 若下一代怎么选、按什么标准打分、什么改动能留下,仍由人写死—— 那只是自我修改,不是递归自我改进。
2️⃣ 自主性必须拆成5级,不能混为一谈
🔹L1 执行人类规定的改进
🔹L2 自己决定怎么改
🔹L3 自己决定下一轮该学什么
🔹L4 用真实反馈持续改记忆/技能/代码/harness
🔹L5 连搜索方法、评估器、研究策略本身都改掉,并传给下一代
3️⃣ 绝大多数研究还停在浅层
梳理约491篇相关工作:
🔹L1占43.8%
🔹L2占31.6%
🔹真正触及L5的只有约5.9%
大量工作仍在执行人类流程,或自动找改法; 把“如何改进”这套机制交给AI的,极少。
4️⃣ L5还要再拆一层,否则会自嗨
形式上递归:机制能改,并能传给下一轮
有效递归:在相近资源和独立评测下,真的产出更强后继系统
论文判断:即使摸到L5,长期稳定累积优势也尚未被证明。
5️⃣ 现有大模型远未闭环
他们用HCI(剩余提升空间指数)指出: 能力进步极不均衡。数学等封闭域已经很高, 软件工程、工具使用、交互环境仍有巨大headroom。
RSI最可能先在“反馈便宜、可验证”的领域点火。
6️⃣ 不同场景速度完全不一样
软件工程:测试可执行,反馈快,最可能先跑通
科学发现:实验贵、信号稀、归因难,继承更慢
具身智能:试错昂贵且不可逆,安全约束更强
结论:不是所有AI都会同时进入自我进化。
7️⃣ 最大卡点不是“会不会改”,而是“改完能不能安全传下去”
安全继承、可靠验证、自主性归因,是通往真正RSI的三道闸。 改错了还会污染后继系统。没有外部评测、回滚和权限隔离,递归就是失控。
一句话总结:
我们可能正站在分界线上,此岸是人类亲手打造的最后一代AI, 彼岸是AI开始改进“改进本身”。
查看论文: #RSI #AGI #ASI #终极AI #奇点 #人工智能 #RecursiveSelfImprovement #GPT6 #Fable5_1 #DeepSeek #Zai #Qwen