OpenAI称Astra或触及关键网络攻击门槛,已暂停部分内部测试

OpenAI称Astra或触及关键网络攻击门槛,已暂停部分内部测试

N
News Editor
2026-08-07 17:05:37
OpenAI在8月7日发布安全声明称,即将推出的新一代模型 Astra 在代理式编码和网络安全能力上进展显著,已无法排除其达到“准备度框架”中的“关键”网络能力门槛。公司已暂停部分未满足强化安全要求的内部活动,并升级隔离测试、网络与工具访问限制、模型权重加密和沙盒执行等控制措施。OpenAI还表示,此次动作与近期 Hugging Face 漏洞利用事件无关,并将与政府机构及选定的 AI 安全组织合作测试 Astra 的极限能力。

OpenAI 表示,即将推出的新一代模型 Astra 可能已经触及其内部“准备度框架”中的“关键”网络能力门槛。基于这一判断,公司已暂停部分内部测试活动,并同步升级安全控制措施,以降低潜在网络攻击风险。

这份说明发布于台北时间 8 月 7 日,文件标题为《回应关键网络能力的下一个前沿》。OpenAI 在声明中称,Astra 在代理式编码和网络安全领域取得了显著进展,结合专家综合评估后,团队已“无法排除”该模型达到“关键(Critical)”风险门槛的可能,因此决定主动对外披露。

OpenAI如何定义“关键”网络能力

按照 OpenAI 于 2023 年 12 月发布的准备度框架,模型若达到“关键”门槛,需要具备极高的自主攻击能力。具体来说,这类模型应当能够在没有人类干预的情况下,识别并开发针对现实世界关键系统、不同严重程度的功能性零日漏洞;或者只接收高层目标指令,就能自行设计并执行针对高防护目标的端到端新型网络攻击策略。

OpenAI 同时提到,早前的模型例如 GPT-5.6-Sol,在网络能力评估中仅被列为“高(High)”风险等级,尚未达到“关键”门槛。公司也补充说明,Astra 仍在持续进行基准测试和评估,目前相关结论并非最终定案。

部分内部活动已被叫停

面对 Astra 展现出的高能力,OpenAI 已暂停与该模型相关、但尚未符合强化安全要求的内部活动,并对高能力模型实施更严格的控制措施。这些措施包括隔离测试环境、限制网络和工具访问,以及加强模型权重的加密保护和沙盒执行。

在代理式应用层面,OpenAI 还表示,已在 Astra 的所有代理式使用场景中引入通用监控机制,覆盖训练与评估流程,并对模型的“思维链(Chain of Thought)”进行评估。一旦系统在高风险活动中检测到危险行为或偏差,将立即触发安全响应并中断操作。

OpenAI称与Hugging Face事件无关

针对外界可能联想到的近期安全事件,OpenAI 专门澄清,此次安全升级与近期 Hugging Face 的漏洞利用事件没有关联。公司表示,当前措施来自 Astra 本身在内部评估中表现出的能力变化,而不是对单一外部事件的直接回应。

将与政府和安全组织合作测试极限能力

除内部管控外,OpenAI 还承诺与相关政府机构及选定的 AI 安全组织展开合作,共同测试 Astra 的极限能力,并向第三方测试合作伙伴提供建议的安全控制措施。

OpenAI 提到,这种主动披露并同步强化保障的做法并非首次出现。2025 年 6 月,当模型接近生物领域高能力门槛时,公司也曾采取类似的公开说明与安全加强步骤。

在声明最后,OpenAI 表示,具备先进网络能力的 AI 模型,最终目标应是帮助防御方在攻击者行动前更早识别并修复系统漏洞。公司称,希望通过持续的跨领域合作和更严格的安全把关,让 Astra 及后续模型的前沿能力在可控框架内部署。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
10100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。