Google2026-10-04 12:46:17Google研究人员提出RRSI,抑制AI代理自我改进中的测试记忆Google 研究人员发现,自我改进的 AI 代理会倾向于记忆测试任务,这会让其在新任务上的性能提升缩小甚至消失。为此,研究团队提出名为 RRSI 的方法,用于抑制这一效应。按 The Decoder 披露,采用该方法后,AI 代理在未见过的基准测试上最高可提升 4.7 分,token 消耗也比未经正则化的版本少约 30%。50