Anthropic公司尚未公开发布的Claude Mythos预览版AI模型,在独立测试中自动发现了数千个严重零日漏洞,涵盖所有主流操作系统和浏览器,迫使公司启动Project Glasswing防御联盟,并配以高达1亿美元的AI使用额度。
据Anthropic官方透露,该模型已完成训练并于2026年4月7日公开宣布,此前因一个配置错误的内容管理系统泄露了约3000份内部文件,让外界首次得见其惊人能力。Claude Mythos预览版目前不向公众或通用API开放,仅限经过审查的合作伙伴使用。
Claude Mythos预览版性能惊人
在网络安全基准测试中,Mythos与Claude Opus 4.6的差距极为显著。Mythos在CyberGym上取得83.1%的成绩,而Opus 4.6仅66.6%;在SWE-bench Verified上达到93.9%对比80.8%;在SWE-bench Pro上为77.8%对比53.4%;在Humanity's Last Exam(无工具)上获得56.8%对比40.0%。模型无需专门的网络安全训练即可发现这些漏洞,其进步来自更广泛的推理、多步规划和自主代理能力。
Mythos的工作流程是:在隔离容器中获取目标代码库,阅读源代码,形成有关内存安全缺陷的假设,编译运行软件,使用Address Sanitizer等调试器,按漏洞概率对文件排序,最终生成带有有效概念验证漏洞的验证报告。部分漏洞几乎无需人工干预。
潜伏数十年的漏洞被揭露
据Tomshardware.com报道,Mythos自主发现了OpenBSD中一个27年老的TCP SACK漏洞——一个微妙的整数溢出,允许攻击者通过恶意数据包远程崩溃任何响应主机。该发现经过约1000次运行,总成本不到2万美元。另一个16年老的FFmpeg H.264漏洞,曾历经超过500万次自动化测试和多次审查,最终被Mythos揪出。
在浏览器测试中,Mythos针对Firefox 147的JavaScript引擎生成了181个完整shell漏洞利用和29个寄存器控制实例,而Claude Opus 4.6在同一测试中仅生成2个shell漏洞。模型还在Linux内核中构建了有效的权限提升链条,从用户空间到root服务器,从100个当前CVE中筛选出40个可利用候选,并成功利用了其中超过一半。
人类验证者审查了198份Mythos生成的漏洞报告,在89%的情况下同意其严重性评级,在98%的情况下评级相差不超过一个级别。
Project Glasswing防御联盟
截至2026年4月7日,已发现的漏洞中不到1%被完全修复。Anthropic负责协调负责任披露,对未修复问题发布加密SHA-3承诺,遵循90+45天的时间表。其中FreeBSD NFS服务器远程代码执行漏洞CVE-2026-4747已公开,该漏洞存在17年,允许未经身份验证的完全root访问。
Project Glasswing是Anthropic的防御性网络安全联盟,创始合作伙伴包括Amazon Web Services、Apple、Broadcom、Cisco、Crowdstrike、Google、JPMorganChase、Linux Foundation、Microsoft、Nvidia和Palo Alto Networks,并扩展至40多个额外关键软件组织。Anthropic还承诺为开源安全捐赠400万美元:其中250万美元给Linux Foundation的Alpha-Omega项目,150万美元给Apache软件基金会。
公司承认Mythos等AI工具降低了发现和利用漏洞的门槛,警告短期风险来自国家行为者(中国、伊朗、朝鲜、俄罗斯)以及犯罪组织,如果类似能力不受控制地传播。公司表示将在未来的Claude Opus版本中引入检测和阻止危险网络安全输出的保护措施,并计划推出面向审查安全专家的网络验证计划。关于合作伙伴发现和修复漏洞的公开报告预计在90天内发布。
此外,Anthropic于2026年4月3日向FEC注册了AnthroPAC,成立了第一个由员工资助的政治行动委员会,为中期选举做准备,AI议题成为焦点。

