首个 RSI 实验,究竟证明了什么?

如果说一级 RSI 证明的是”系统能把内层 Agent 改得更好”,那么二级 RSI 要问的是:它改出来的 Agent,能不能反过来成为更好的外层改进者。接下来,可能还要具备另一套能力:保存每次变异的来历,重放它通过的实验,隔离可能有问题的修改,知道哪一项指标是私有门槛,哪一项只是好看的公开分,并为”机器找到但人暂时看不懂的方案”设计可控的接口。它没有修改基础模型权重,没有证明 Agent 能持续提升自己的”研究能力”,没有证明进步会在固定预算下加速,也没有解决自动生成代码的可解释性和可维护性问题。

原文连接