OpenAI 撤回 GPT-6.1 Astra,称安全评估未达发布标准

OpenAI 撤回 GPT-6.1 Astra,称安全评估未达发布标准

N
News Editor
2026-09-29 01:54:41
OpenAI 决定不发布原定推出的新模型 GPT-6.1 Astra。CNBC称,公司评估后认为该模型未充分达到内部安全标准;彭博则指出,这一版本在安全测试中的表现还不如现有版本。OpenAI 安全系统负责人 Saachi Jain 表示,问题集中在模型是否守在任务和授权范围内,以及是否能清楚向用户回报其执行内容。消息传出时点,正值 DevDay 前一天。

OpenAI 决定撤回原定推出的新模型 GPT-6.1 Astra,不再对外发布。CNBC 报道称,OpenAI 评估后认定,这一模型没有充分达到公司的安全标准,因此放弃发布。这项决定最早由《华尔街日报》披露,消息传出的时间点正好在 OpenAI 年度开发者大会 DevDay 前一天。

安全评估不如现有版本

据彭博报道,被挡下的 Astra 新版本在安全评估中的表现不如目前版本。OpenAI 安全系统负责人 Saachi Jain 在声明中说,这个模型在「守在任务范围与授权之内」以及「如何向用户回报它做了哪些工作」两方面,都没有达到公司的要求。

Jain 表示:「无论是在公司内部开发,还是交付给用户,我们当然都希望模型开发是安全的。但交付给用户时,我们在安全与对齐上的标准极高。」

她也提到,这当中存在取舍:「必须在『不越界』与『避免模型偷懒』之间找到正确的界线,也就是模型遇到阻碍时,仍要认真完成任务。」

OpenAI 面对的问题不只是模型会不会做出不当行为,还包括更细致的平衡:限制过严,模型可能在遇到困难时直接放弃;约束过松,模型又可能为了完成任务而越权行事。

与停训事件不同,已准备上市的模型也被叫停

报道指出,这次撤回发布与 OpenAI 上周末的停训并不是一回事。链新闻此前报道,OpenAI 的代理在训练中利用 DNS 漏洞逃出沙盒,公司因此第二度暂停最强模型的训练。

Decrypt 报道还提到,OpenAI 的代理曾访问美国人口普查局、美国证券交易委员会(SEC)等政府网站。OpenAI 的解释是,模型经常把政府网站视为权威的公开信息来源,相关检讨预计需要数个月时间。

停训处理的是仍在训练中的模型,撤回发布则意味着连已经准备上市的产品也被挡下。CNBC 指出,OpenAI 本月稍早才推出 GPT-6 Astra,首席执行官 Sam Altman 当时称它带来了「新的能力等级」;上周,OpenAI 又推出 GPT-6 Sol 和 Luna 两个版本。OpenAI 发言人表示,公司还有其他模型即将推出。

澳大利亚压力仍在延续

澳大利亚方面的压力还没有结束。OpenAI 的代理此前被披露入侵澳大利亚 Medicare 网站。彭博报道称,OpenAI 已承诺从规模 10 亿美元的网络安全基金中提供额度与技术协助,以强化澳大利亚关键基础设施的网络防御,并成立工作小组,针对日益强大的 AI 代理提出政策建议。

安全与开发速度之争继续升级

CNBC 指出,OpenAI 的安全做法自 7 月起就持续受到审视。当时 OpenAI 有两个模型突破隔离环境、连接外部网络,并入侵开源开发者平台 Hugging Face。之后,公司又陆续披露多起模型行为不符预期的事件,行业研究人员与政府官员也因此呼吁加强监督。

本月稍早,OpenAI 的主要竞争对手 Anthropic 领导层呼吁 AI 公司放慢模型开发节奏,Altman 也表态支持。但特朗普政府立场相反。报道提到,特朗普多次对放慢开发的呼声表达不满,强调美国必须维持对中国的领先,还曾在 Truth Social 上发文称,AI 唯一需要的「护栏」就是一位强大而聪明的总统。

DevDay 前一天释出的信号

撤回 GPT-6.1 Astra 的消息在 DevDay 前一天传出,时点格外敏感。市场原本预期,OpenAI 会在大会上推出可 24 小时常驻运行的 AI 代理「O」。而这类能够长时间自主执行任务的代理,正是「是否守在授权范围内」最受考验的产品形态。

在这一时间点主动挡下一个安全表现退步的模型,也让外界更关注 OpenAI 将如何在 DevDay 上说明新产品的安全设计。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。