Google研究人员提出RRSI,抑制AI代理自我改进中的测试记忆

Google研究人员提出RRSI,抑制AI代理自我改进中的测试记忆

N
News Editor
2026-10-04 12:46:17
Google 研究人员发现,自我改进的 AI 代理会倾向于记忆测试任务,这会让其在新任务上的性能提升缩小甚至消失。为此,研究团队提出名为 RRSI 的方法,用于抑制这一效应。按 The Decoder 披露,采用该方法后,AI 代理在未见过的基准测试上最高可提升 4.7 分,token 消耗也比未经正则化的版本少约 30%。

Techub News 消息,Google 研究人员发现,自我改进的 AI 代理倾向于记忆其测试任务,这会导致其在新任务上的性能提升缩小或消失。

研究人员提出了一种名为 RRSI 的新方法,用来抑制这一效应。根据 The Decoder 披露,采用该方法后,AI 代理在未见过的基准测试上得分最高提升 4.7 分,同时比未经正则化的版本少消耗约 30% 的 token。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
500

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。