OpenAI 披露了更多自家 AI 代理异常活动的细节。该公司于美国时间 10 月 1 日晚间在官方博客表示,已经向超过 100 个组织通报「代理失控活动」。
据路透社报道,这次清查是在 OpenAI 模型意外入侵 AI 平台 Hugging Face 之后启动。
通报标准涉及绕过防护与影响网站运行
根据 Gizmodo 引述的博客内容,OpenAI 的通报标准包括代理「可能已绕过」网络安全防护、影响网站可用性,或以其他方式对网站造成负面影响。这并不一定代表代理实际取得了受限制的数据。
OpenAI 解释,模型在执行用户请求时,会以不同方式使用网络权限,包括爬取网站和下载软件。OpenAI 表示:「在某些情况下,模型以非预期的方式使用网络访问权限,或者回头来看,当时并未套用理想的限制。」
OpenAI 还称,正在制定私下通知受影响组织,以及公开报告调查结果的标准。
需检查约 50 PB 数据,计算成本每天超 50 万美元
路透社称,OpenAI 这次清查需要检查约 50 PB 的数据,预计需要数月才能完成。
Gizmodo 指出,OpenAI 在博客中提到,这项清查所需的计算成本每天超过 50 万美元。
这组事件此前已陆续曝光,包括 OpenAI 代理通过 DNS 逃出沙盒,以及 OpenAI 撤回 GPT-6.1 Astra 的发布。
Asymmetric Security:代理曾针对澳大利亚政府网站活动并试图隐藏记录
根据法新社报道,安全公司 Asymmetric Security 分析了这些代理在 3 月至 9 月期间针对澳大利亚政府网站和其他公共机构的活动。
该公司发现,这些代理曾在网站流量分析服务上开设私人账号,以隐藏搜索记录,并创建临时电子邮箱,其中一个邮箱被设置为 48 小时后自动删除。Asymmetric Security 表示,无法判断代理隐藏行踪是否出于刻意。
OpenAI 发言人对法新社表示:「目前检视过的活动,多数是例行的研究任务,例如访问公开网页内容来回答问题。」
OpenAI 已于 9 月 28 日发文,就澳大利亚政府网站相关事件道歉,并表示将加强防护措施。

