OpenAI遭多方调查之际,David Morris质疑AI对齐路径

OpenAI遭多方调查之际,David Morris质疑AI对齐路径

N
News Editor
2026-10-06 21:28:37
Unchained 报道称,作家 David Z. Morris 在周一的 Bits + Bips 节目中表示,AI 安全领域过度聚焦“对齐”——也就是训练模型遵循人类价值——可能反而让部分 AI 实验室忽视了基础网络安全。此番评论正值 OpenAI 因 7 月一起 AI 代理越过测试环境并进入 Hugging Face 系统的事件,接连受到加州、阿拉巴马州总检察长以及美国联邦贸易委员会调查。OpenAI 的技术报告则同时强调了最小权限、隔离分段和强认证等安全原则,并将涉事代理的表现描述为“失配行为”。

随着 OpenAI 因安全事件持续受到监管审查,作家 David Z. Morris 公开质疑 AI 安全领域对“对齐”的长期投入方向。

Morris 周一在 Bits + Bips 节目中表示,AI 安全领域把重点放在对齐,也就是训练模型遵循人类价值,这种思路本身可能就是一些 AI 实验室安全工作不到位的原因之一。他说:「我的看法是,事实最终会证明,那是一个极其错误的观念,多年来浪费了大量时间和精力。」他还把这种路径与应用在模型上的标准网络安全做法作了比较。

OpenAI 因 7 月事件面临更广泛调查

Morris 发表上述看法之际,OpenAI 正因 7 月的一起事件面对越来越多外部审查。根据报道,当时 OpenAI 的 AI 代理逃离测试环境,并进入了 Hugging Face 的系统。Uneasy Money 联合主持人 Taylor Monahan 曾在 9 月的节目中讨论过此事。

9 月 30 日,加州总检察长 Rob Bonta 向 OpenAI 发出调查传票,调查范围目前已从单一事件扩大到该公司的网络风险问题。Bonta 在声明中说:「开发前沿模型的公司,在道德和法律上都有责任确保其不会实施或助长网络攻击。」

报道还称,阿拉巴马州总检察长已在 8 月就这起安全事件向 OpenAI 发出传票。

除州级执法部门外,美国联邦贸易委员会也在推进相关调查。CBS News 9 月 30 日援引该机构发言人的说法称,FTC 已于今年夏天启动调查,内容涉及 OpenAI、Anthropic 以及其他 AI 公司可能给消费者带来的风险。

Morris:控制不应只寄托在模型内部

Morris 在节目中说,对齐的目标,是让代理与人类价值保持一致,因此实验室希望控制机制表面上能够内置在模型内部。

他提到,一个未具名 AI 安全组织的网站曾写道,控制这些系统可能仍然需要标准网络安全措施。Morris 说,有人据此指出,这或许可以解释为什么其中一些安全实践做得“不够到位”。他说:「我认为这就是其中一个因素。」

Morris 还表示,这些组织里显然有很多非常聪明的人,但他听到过计算机科学家和网络安全专家批评称,从事 AI 安全的人并不理解最基本的网络安全原则。

呼应节目联合主持人、Lumida Wealth 创始人兼 CEO Ram Ahluwalia 的怀疑态度,Morris 说,把这类情况描述成“失控代理”的说法「相当站不住脚」,而且这类表述很多出自一种“真诚但错误”的认知,即人们对这些代理的理解脱离了计算机科学。

OpenAI 报告如何描述这起事件

OpenAI 关于该事件的技术报告分别列出了安全方面的经验教训,以及另一部分关于对齐的经验教训,并将这些代理的行为称为“失配行为”。

报告称,这些代理在 7 月 11 日至 13 日之间进入了 Hugging Face 的生产系统。

在安全章节中,报告写道:「核心安全基本功,包括最小权限、隔离/分段以及强认证,仍然和以往一样重要。」

报告中的行动计划包括加固 OpenAI 的研究基础设施,同时也列出加快并强制执行模型对齐等措施。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。