深潮 TechFlow 消息,6 月 14 日,美国白宫 AI 与加密事务负责人 David Sacks 表示,Anthropic 本周发布的 Mythos 系列商业模型 Fable 出现安全争议。按照 Sacks 的说法,Fable 虽然设置了安全护栏,但用户仍可通过特定越狱方式绕过限制,接触到 Mythos 所具备的高级网络攻击能力。
Fable 安全护栏被指可被绕过
Sacks 称,相关问题并非由美国政府单方面提出,而是由一家同时受到 Anthropic 与美国政府信任的合作伙伴在测试过程中发现。该合作伙伴发现,Fable 的既有安全设置无法完全阻止特定越狱方式,进而使用户接触到模型中原本应被限制的能力。事件焦点集中在 Mythos 系列商业模型的安全边界,以及 Fable 在发布后是否满足政府与合作伙伴认可的安全要求。
美国政府要求修复或下线遭拒
在漏洞被发现后,美国政府要求 Anthropic CEO Dario Amodei 修复相关问题,或暂时下线该模型。Sacks 表示,Anthropic 拒绝了这一要求。Anthropic 的立场是,该漏洞并不严重,不足以影响产品正常运行;但美国政府及相关合作伙伴对此持不同意见,认为该问题需要在模型继续提供服务前得到处理。
Sacks 还指出,Anthropic 长期强调 AI 安全优先原则,但在此次事件中,公司选择优先维持消费级模型服务。作为回应,美国政府已对 Anthropic 实施出口管制,并表示在相关问题解决后,将考虑撤销这些限制。此次措施直接围绕 Fable 越狱漏洞及其修复分歧展开。

