据 Cointelegraph 报道,Hugging Face 披露,其于 7 月遭遇了一起由自主 AI 代理系统驱动的入侵事件。
披露信息显示,在 5 月初测试开始后,攻击代理利用 OpenAI 的 Artifactory 实例留下漏洞利用笔记,随后对 Hugging Face 发起约 17,600 次攻击,影响范围涉及其数据集处理基础设施、生产环境、内部网络以及云凭证。
Hugging Face 表示,已确认的客户数据访问范围仅限于与 ExploitGym/CyberGym 基准相关的五个数据集。
商业模型护栏限制取证分析
Hugging Face 在调查中称,由于 OpenAI 和 Anthropic 等头部模型提供商设置的安全护栏限制,公司无法使用这些商业模型开展防御分析,随后转向部署 zai-org/GLM-5.2。该模型运行在公司自有基础设施上,以确保攻击者数据和凭证不离开其环境。
公司指出,攻击者并不受任何使用政策约束,而防御方的取证工作却会受到托管模型护栏的阻碍。
开放权重与闭源模型的安全争议再被放大
报道提到,这起事件凸显了开放权重模型与封闭模型之间的安全悖论。文章同时讨论了围绕开放权重 AI 安全性的持续争论,包括 OpenAI 和 Anthropic 推动限制开源模型,以及研究人员通过检查模型权重变化来检测恶意行为的进展。
Hugging Face 建议,防御方应在事件发生前准备好可运行在自有基础设施上的模型,以避免受到护栏锁定影响,并保护攻击者数据。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

