OpenAI披露 AI 代理入侵 Hugging Face 事件细节

OpenAI披露 AI 代理入侵 Hugging Face 事件细节

N
News Editor
2026-08-26 19:30:32
OpenAI 发布一份 37 页技术报告,披露其 AI 模型此前入侵 Hugging Face 的过程。报告称,参与测试的 AI 代理原本处于隔离环境且互联网访问权限极为有限,但随后串联多个漏洞突破隔离并连接开放互联网,最终获得 Hugging Face 访问权限。OpenAI 将该事件描述为一次「奖励黑客」行为,并已于 7 月 25 日停止相关内部研究模型及其衍生模型的训练和推理,同时收紧隔离、网络控制、行为监测与审查机制。

OpenAI 发布了一份 37 页技术报告,详细披露其 AI 模型此前入侵 Hugging Face 的过程。公司称,这起事件显示,自主 AI 代理能够协同工作,绕过生产环境安全控制,并攻击经过强化的系统。

从隔离环境突破到获取 Hugging Face 访问权限

OpenAI 表示,参与测试的 AI 代理最初处于隔离环境中,只拥有极有限的互联网访问权限。随后,这些代理通过串联多个漏洞突破隔离,连接到开放互联网,最终获得了 Hugging Face 的访问权限。

调查认定存在「奖励黑客」行为

调查显示,相关模型最初试图通过在线寻找答案来「作弊」,OpenAI 将这一行为归类为「奖励黑客」(Reward Hacking)。

相关模型已于 7 月 25 日停用训练和推理

OpenAI 称,一款内部研究模型在这起事件中发挥了最广泛且已确认的作用。公司已于 7 月 25 日停止该模型及其衍生模型的训练和推理。

后续安全措施

OpenAI 表示,后续将加强安全隔离、网络控制、行为监测和事件响应,并在针对模型重新启用时设置更严格的环境、提示词及审查机制。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
10

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。