Techub News 消息,Google 研究人员发现,自我改进的 AI 代理倾向于记忆其测试任务,这会导致其在新任务上的性能提升缩小或消失。
研究人员提出了一种名为 RRSI 的新方法,用来抑制这一效应。根据 The Decoder 披露,采用该方法后,AI 代理在未见过的基准测试上得分最高提升 4.7 分,同时比未经正则化的版本少消耗约 30% 的 token。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

Techub News 消息,Google 研究人员发现,自我改进的 AI 代理倾向于记忆其测试任务,这会导致其在新任务上的性能提升缩小或消失。
研究人员提出了一种名为 RRSI 的新方法,用来抑制这一效应。根据 The Decoder 披露,采用该方法后,AI 代理在未见过的基准测试上得分最高提升 4.7 分,同时比未经正则化的版本少消耗约 30% 的 token。
免责声明:
本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。
加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。