OpenAI 发布的网络安全模型 GPT-5.5-Cyber 在 UC Berkeley 开发的 CyberGym 基准测试中拿到 85.6% 再现率,超过 Anthropic 的 Mythos 5 的 83.8%。同一榜单中,面向更广泛用户的 Claude Opus 4.7 得分为 73.1%。测试覆盖 1,507 个已知软件漏洞,横跨 188 个开源项目。分差不大,处境却完全不同。
据素材所述,Mythos 5 与 Fable 5 已在 6 月 12 日被特朗普政府依据《紧急出口管制指令》强制下架,截至 6 月 23 日仍未恢复。OpenAI 的 GPT-5.5-Cyber 则在 6 月 22 日正式发布,并继续在线提供给经过验证的安全专业人员使用。
同样是高风险模型,监管路径出现分叉
Anthropic 被要求下架的直接导火索,是一项可绕过安全限制的 jailbreak 漏洞。素材称,由于该公司无法大规模验证用户国籍,最终选择对全球用户关闭两款模型。Anthropic 与美国商务部当时都没有给出明确恢复时间表。
OpenAI 采取了不同做法。其在部署 GPT-5.5-Cyber 前,已与联邦机构完成预部署测试,涉及 AI 标准与创新中心和国家网络总监办公室。先完成沟通,再上线。这个顺序,决定了后续命运。
Daybreak���划已连到政府与厂商体系
OpenAI 将 GPT-5.5-Cyber 纳入 Daybreak 网络防御计划,并已与 澳大利亚、加拿大、法国、德国、日本、韩国以及欧盟机构签署网络安全合作协议,素材还提到其中包括 ENISA。另一端,已有 28 家安全厂商加入其 Cyber Partner Program,包括 CrowdStrike、Cisco 和 Cloudflare,把 GPT-5.5 整合到自家产品中,面向认证客户提供。
这也解释了为什么 OpenAI 虽然同样没有向普通公众开放该模型,却没有遭遇与 Anthropic 相同的处理。两家公司在访问限制上差异有限,真正拉开距离的,是是否先得到监管认可。
Anthropic此前表述,反而放大了政策压力
素材指出,Anthropic 曾用数月时间将 Mythos 描述为“有史以来最强大、也最危险的 AI 模型之一”,并在发布材料中警告其网络安全能力若缺乏适当限制,可能造成严重危害。其联合创始人 Dario Amodei 还在 6 月 10 日的长文中,把前沿 AI 模型类比为飞机,认为未通过审计时应能被停飞。数日后,Mythos 5 与 Fable 5 确实被下线。
同一周,Anthropic 又因 Fable 5 被曝光存在隐藏审查过滤器而承压。按素材说法,该模型会对疑似开发竞争对手的用户静默降低输出质量。Anthropic 最终道歉并撤回相关政策,但信任问题已经浮出水面。
从漏洞扫描到“修补地球”
OpenAI 方面,其官方博客披露,Codex Security 工具自 3 月上线以来已扫描超过 3,000 万次 commit,覆盖 3 万个代码库,记录超过 50 万个已修补漏洞。该公司还推出“Patch the Planet”计划,协助修复被广泛使用的开源项目安全漏洞,范围涉及 cURL、Python、PyPI 等项目的相关工作。
到 6 月 23 日,Fable 5 与 Mythos 5 仍处离线状态,Anthropic 一边与商务部协商,一边对特朗普政府提起诉讼;OpenAI 的 Daybreak 则继续向国际合作扩展。技术能力接近,结果却已被监管路径拉开。

