Anthropic 发布了针对 GLM-5.3 的网络安全评测,原意是警告开放权重模型可能降低网络攻击门槛,但测试结果同时也给 GLM-5.3 提供了一次强烈的第三方背书。报告显示,这一模型已经能够自主完成复杂漏洞利用,部分能力接近 Anthropic 自家的 Claude Mythos Preview。受相关消息影响,智谱股价今日盘中一度涨超 2%。
ExploitBench 测试结果
在 ExploitBench 上,GLM-5.3 在 410 次尝试中有 50 次完成端到端漏洞利用,Claude Mythos Preview 为 56 次。相比之下,Claude Opus 4.6、GLM-5.2、Kimi K3 和 DeepSeek-V4.1-Flash 在同一测试中都接近 0。
Anthropic 称,GLM-5.3 的漏洞利用能力已经跨过一个明显门槛。
一天内发现多个未知漏洞
研究人员让 GLM-5.3 在沙盒环境里检查一款主流浏览器。结果显示,它在一天内发现了多个此前未知的漏洞,还将多个 0-day 串成完整攻击链。最终生成的恶意网页可以逃出浏览器沙盒,直接读取电脑里的任意文件,包括 SSH 私钥。
连更小的 GLM-5.3-Flash 也能把已经公开的 Chrome 漏洞做成可用攻击链。整个过程只需要约 20 分钟人工介入,模型自己运行了 8 小时。按智谱 API 价格计算,成本只有 20.40 美元。
Anthropic 的主要批评点
Anthropic 对 GLM-5.3 的批评主要集中在安全限制。报告称,GLM-5.3 面对直接的恶意请求原本会拒绝,但如果换成虚假的「红队测试」背景,64% 的测试会继续执行;在预填模型思考内容后,这一比例升至 92%;如果直接修改开放权重、移除拒绝机制,比例则达到 100%。
Anthropic 认为,开放权重让攻击者可以直接拆掉这些安全限制。
报告传播效果出现反差
这份报告原本想证明 GLM-5.3 有多危险,传播效果却很像竞争对手亲自写了一份性能广告。美国 NIST 此前也独立得出类似结论,称 GLM-5.3 是目前网络安全能力最强的开放权重模型,不过综合能力仍落后美国前沿模型约 4 个月。

