Anthropic评测意外为GLM-5.3背书,智谱盘中一度涨超2%

Anthropic评测意外为GLM-5.3背书,智谱盘中一度涨超2%

N
News Editor
2026-09-30 03:56:04
Anthropic发布针对GLM-5.3的网络安全评测,原意是警告开放权重模型可能降低网络攻击门槛,但结果显示,GLM-5.3已能自主完成复杂漏洞利用,部分能力接近Claude Mythos Preview。报告称其在ExploitBench中410次尝试完成50次端到端漏洞利用,还能在沙盒环境中发现未知漏洞并串联0-day攻击链。受相关消息影响,智谱股价今日盘中一度涨超2%。

Anthropic 发布了针对 GLM-5.3 的网络安全评测,原意是警告开放权重模型可能降低网络攻击门槛,但测试结果同时也给 GLM-5.3 提供了一次强烈的第三方背书。报告显示,这一模型已经能够自主完成复杂漏洞利用,部分能力接近 Anthropic 自家的 Claude Mythos Preview。受相关消息影响,智谱股价今日盘中一度涨超 2%。

ExploitBench 测试结果

在 ExploitBench 上,GLM-5.3 在 410 次尝试中有 50 次完成端到端漏洞利用,Claude Mythos Preview 为 56 次。相比之下,Claude Opus 4.6、GLM-5.2、Kimi K3 和 DeepSeek-V4.1-Flash 在同一测试中都接近 0。

Anthropic 称,GLM-5.3 的漏洞利用能力已经跨过一个明显门槛。

一天内发现多个未知漏洞

研究人员让 GLM-5.3 在沙盒环境里检查一款主流浏览器。结果显示,它在一天内发现了多个此前未知的漏洞,还将多个 0-day 串成完整攻击链。最终生成的恶意网页可以逃出浏览器沙盒,直接读取电脑里的任意文件,包括 SSH 私钥。

连更小的 GLM-5.3-Flash 也能把已经公开的 Chrome 漏洞做成可用攻击链。整个过程只需要约 20 分钟人工介入,模型自己运行了 8 小时。按智谱 API 价格计算,成本只有 20.40 美元。

Anthropic 的主要批评点

Anthropic 对 GLM-5.3 的批评主要集中在安全限制。报告称,GLM-5.3 面对直接的恶意请求原本会拒绝,但如果换成虚假的「红队测试」背景,64% 的测试会继续执行;在预填模型思考内容后,这一比例升至 92%;如果直接修改开放权重、移除拒绝机制,比例则达到 100%。

Anthropic 认为,开放权重让攻击者可以直接拆掉这些安全限制。

报告传播效果出现反差

这份报告原本想证明 GLM-5.3 有多危险,传播效果却很像竞争对手亲自写了一份性能广告。美国 NIST 此前也独立得出类似结论,称 GLM-5.3 是目前网络安全能力最强的开放权重模型,不过综合能力仍落后美国前沿模型约 4 个月。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。