人工智能公司Anthropic披露,其尚未面向公众发布的预览模型Claude Mythos,已在主流操作系统与浏览器中自主识别出数千个高危零日漏洞。这一结果促使公司同步推出网络安全防御联盟Project Glasswing,并计划向防御方提供最高1亿美元的Mythos使用额度。
安全测试成绩大幅领先前代模型
根据Anthropic公布的数据,Claude Mythos在网络安全基准测试Cybergym中取得83.1%,明显高于Claude Opus 4.6的66.6%。在SWE-bench Verified上,Mythos得分93.9%,对比前代的80.8%;在SWE-bench Pro上,成绩为77.8%,较前代的53.4%高出24.4个百分点;在无工具条件下的Humanity's Last Exam中,Mythos也达到56.8%,高于前代的40.0%。
Anthropic表示,这些提升并非来自专门的网络安全微调,而是源于模型在推理、多步骤规划和自主代理行为上的整体进步。给定隔离容器中的目标代码库后,Mythos能够自行阅读源码、提出缺陷假设、编译和运行软件,并借助Address Sanitizer等调试工具完成验证,最终输出附带可运行PoC的漏洞报告。
陈年漏洞被重新挖出
报道提到,一项存在于OpenBSD TCP SACK中的27年老漏洞,在约1,000次运行后被模型自主发现,总成本低于2万美元。该问题属于隐蔽的整数溢出,可使攻击者通过构造恶意数据包远程导致目标主机失效。另一个FFmpeg H.264相关漏洞已存在16年,在经历超过500万次自动化测试和多轮审计后,仍直到Mythos介入才被识别出来。
浏览器测试同样引发关注。在针对Firefox 147 JavaScript引擎的测试中,Mythos生成了181个完整shell利用以及29个寄存器控制案例,而Claude Opus 4.6在相同测试中仅生成2个shell利用。Anthropic还称,该模型能够在Linux内核中构建从普通用户到root的权限提升链路:在筛选100个近期CVE后,它锁定了40个可利用候选目标,并成功利用其中一半以上。
在人类验证环节,评审人员检查了模型提交的198份漏洞报告,并在89%的案例中认可其严重性判断;若放宽到相差一个等级以内,吻合度达到98%。
Glasswing联盟瞄准防御场景
Anthropic称,目前被识别出的漏洞中,完成修复的比例仍不足1%。公司正按照负责任披露流程推进处理:对尚未修复的问题先公布SHA-3加密承诺,并遵循90天加45天的时间窗口后再公开完整细节。已被点名的案例之一,是存在17年的FreeBSD NFS服务器远程代码执行漏洞 CVE-2026-4747,其影响可导致未认证攻击者直接获取完整root权限。
与模型一同公布的Project Glasswing,被视为Anthropic试图在类似能力大范围扩散前,优先将其导向防御用途的举措。该项目的创始合作伙伴包括Amazon Web Services、Apple、Broadcom、Cisco、Crowdstrike、Google、JPMorganChase、Linux Foundation、Microsoft、Nvidia和Palo Alto Networks,并进一步向40多家关键软件组织开放接入。
除算力与模型额度支持外,Anthropic还承诺为开源安全捐赠400万美元:其中250万美元通过Linux Foundation下属OpenSSF捐给Alpha-Omega,另有150万美元捐给Apache Software Foundation。
能力跃升也带来外溢风险
Anthropic承认,像Mythos这样的AI工具正在显著降低发现和利用漏洞的门槛,若类似能力失控扩散,短期内可能被国家行为体或犯罪组织利用。公司点名提到来自中国、伊朗、朝鲜和俄罗斯等方面的潜在风险,并认为在防御体系完全吸收这类技术之前,网络安全领域可能经历一段动荡期。
为此,Anthropic表示,未来版本的Claude Opus将加入更多网络安全输出防护机制,用于识别并拦截危险内容,同时计划推出面向经验证安全专业人士的网络安全验证项目。公司预计将在90天内发布一份公开报告,汇总合作伙伴测试结论以及已完成修复的漏洞情况。

