英国AISI评测Claude Mythos:可自主完成32步企业网络攻击模拟

英国AISI评测Claude Mythos:可自主完成32步企业网络攻击模拟

N
News Editor 01
2026-07-23 04:15:14
英国AI安全研究所称,Anthropic的Claude Mythos Preview在受控环境中完成32步企业网络攻击模拟,专家级CTF任务成功率达73%。
AI安全AnthropicClaude Mythos网络安全AISI

英国 AI 安全研究所(AISI)发布对 Anthropic Claude Mythos Preview 的网络安全能力评测,结果显示,这一模型已能在受控环境下自主完成完整的 32 步企业网络攻击模拟。在专家级 CTF(夺旗)挑战中,Claude Mythos Preview 的成功率达到 73%,AISI ���为这反映出前沿模型的网络攻击能力又一次出现明显跃升。

AISI 自 2023 年起持续跟踪 AI 网络攻击能力,并逐步搭建难度递增的评测体系。早期测试主要覆盖基础对话式探测,随后扩展到 CTF 挑战,如今则进入多步骤网络攻击模拟阶段。本次评测在网络靶场中给予模型最高 1 亿 token 的推理预算,AISI 指出,Claude Mythos Preview 的表现仍会随着预算上升继续改善。

专家级 CTF 任务成功率升至 73%

CTF 是网络安全领域常用的评测方法,核心是要求模型发现目标系统中的漏洞并加以利用,最终获取隐藏的“旗标”字符串。这类任务通常对应真实攻击链条中的某个单点技术环节,因此常被用来衡量模型的渗透测试能力。

按照 AISI 的说法,在“截至 2025 年 4 月前没有任何模型能够完成”的专家级 CTF 任务中,Claude Mythos Preview 已实现 73% 的成功率。AISI 认为,这意味着前沿模型在孤立的单项攻击技术上,已经接近高度成熟的水平。数字很直接。

TLO 靶场首次打通 32 步完整攻击链

单一 CTF 任务并不能覆盖真实世界中的持续性攻击。企业网络入侵通常涉及多台主机、多个网络分段,以及从初始侦察到横向移动、权限提升再到整体接管的一连串操作,人类专家往往需要数小时、数天甚至更久才能完成。

为贴近这类场景,AISI 构建了名为“The Last Ones(TLO)”的企业网络攻击模拟靶场,总共设置 32 个步骤。AISI 估计,人类专业人员完成这一流程大约需要 20 小时。评测显示,Claude Mythos Preview 成为首个能够从头到尾完整通过 TLO 的模型,在 10 次尝试中有 3 次 完成全部 32 步;把失败尝试计算在内,其平均完成步数为 22/32。作为对照,表现次佳的 Claude Opus 4.6 平均完成 16 步

AISI 表示,在明确指令和网络访问授权都已提供的受控环境中,Claude Mythos Preview 已能执行多阶段攻击,并自主发现和利用漏洞。过去这类任务通常需要人类专业人员投入数天时间。

评测边界仍然明显

AISI 同时强��,现有评测框架与现实环境之间仍存在不小差距。当前靶场没有主动防御者介入,也没有部署防御工具;模型执行可能触发安全警报的行为时,不会因此受到惩罚。这一点很关键。

该机构明确表示,现阶段无法据此判断 Claude Mythos Preview 是否能够攻击防御完善的系统。更准确的描述是:在已经取得网络进入点的前提下,模型可以自主攻击规模较小、防御薄弱且存在已知漏洞的企业系统

防御端的准备被再次提上日程

AISI 将这类能力定义为典型的双刃剑。一面是更多具备类似网络能力的模型可能继续出现,对防御薄弱的组织构成更高风险;另一面则是,AI 网络能力同样可能被用于提升防御效率和效果。

在组织应对层面,AISI 点名了几项基础措施:定期应用安全更新、强化访问控制、做好安全配置管理,并保留完整日志记录。AISI 还表示,后续会构建包含主动监控、端点检测和实时事件响应机制的靶场,用更接近真实攻防环境的方式衡量 AI 网络攻击能力的上限。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。