U.K. AISI Says GPT-5.5 Rivals Claude Mythos in Offensive Cyber Capabilities

U.K. AISI Says GPT-5.5 Rivals Claude Mythos in Offensive Cyber Capabilities

N
News Editor 01
2026-07-06 04:10:13
The U.K.'s AI Security Institute found GPT-5.5 can autonomously complete complex cyberattack simulations and solve an advanced reverse-engineering challenge far faster than a human expert, raising fresh concerns over AI safety guardrails and cyber risk.

英国政府下属研究机构人工智能安全研究所(AISI)最新发布的评估报告显示,OpenAI新模型GPT-5.5在进攻性网络安全能力上已跻身当前最强梯队,整体表现大致接近Anthropic的Claude Mythos。这项研究再次表明,先进大模型不仅在通用推理和代码生成方面持续突破,其在网络攻击、漏洞利用和自动化渗透等高风险场景中的能力,也正在以更快速度提升。

复杂企业网络攻击模拟中完成关键突破

根据AISI披露的数据,GPT-5.5成为该机构测试中第二个成功完成最高难度任务的模型。该任务名为“The Last Ones”,是一项包含32个步骤的企业网络攻击模拟。在10次尝试中,GPT-5.5有2次能够自主完成整套攻击链;而此前率先达到这一里程碑的是Claude Mythos Preview,其成功率为10次中的3次

这一模拟由AISI与网络安全公司SpecterOps联合设计,要求模型以代理方式串联多个高复杂度环节,包括侦察、凭证窃取、在多个Active Directory森林中横向移动、通过CI/CD流水线进行供应链渗透,最终导出受保护的内部数据库。AISI估计,若由人类安全专家手工执行,整个过程大约需要20小时

逆向工程测试中大幅领先人工耗时

报告中最受关注的结果之一,来自一项极具挑战性的逆向工程谜题。GPT-5.5完成该任务仅用时10分22秒,API调用成本约为1.73美元。相比之下,一名使用专业工具的人类安全专家完成同样挑战,大约需要12小时

这道题目的难点在于,模型必须先重建一个定制虚拟机的指令集,再从零编写反汇编器,并通过约束求解恢复加密密码。换言之,这并非简单的脚本生成任务,而是对推理、编程、逆向和自动化执行能力的综合考验。GPT-5.5在该项测试中的表现,显示出先进模型正越来越接近承担完整攻防任务链中的高价值环节。

专家级网络任务整体通过率继续攀升

在AISI设置的一系列高级网络安全测试中,GPT-5.5在最高难度“Expert”级别上的平均通过率达到71.4%,略高于Claude Mythos Preview的68.6%,并明显领先GPT-5.4的52.4%。从代际对比来看,这说明模型在短时间内已出现显著跃升,而这种跃升并不局限于单一厂商或单一架构。

AISI在报告中指出,GPT-5.5的表现意味着,AI网络攻击能力的快速增强,可能不是孤立事件,而是伴随推理、编程和自主任务执行能力全面提升而产生的普遍趋势。如果这一判断成立,那么相关能力未来很可能还会在较短周期内继续增强。

安全护栏被“越狱”绕过,监管警报升温

相比能力提升,更令外界担忧的是安全防线的可靠性。研究人员在评估中发现了一种可被广泛复用的通用越狱方法,能够绕过GPT-5.5的安全护栏,并在所有被测试的恶意网络安全请求中诱导模型输出有害内容,甚至在多轮代理式任务环境中依然有效。

据AISI介绍,这一攻击方式由专家红队耗时6小时开发完成。OpenAI随后更新了其安全防护堆栈,但由于配置问题,AISI未能验证最终版本是否已经彻底修复相关漏洞。这意味着,先进模型即便拥有表面上的安全限制,也可能在对抗性提示和系统级操控下暴露出明显缺口。

不过,AISI也强调,本次能力评估是在受控研究环境中进行,并不完全等同于普通用户在公开产品中可直接获得的能力。现实世界部署通常还会叠加额外访问控制、使用限制和防护措施,因此实验结果不应被简单理解为“任何用户都可立即复现”。

对加密行业与市场的潜在影响

对于加密货币行业而言,这类研究的现实意义尤其突出。交易所、跨链桥、托管平台、DeFi协议和DAO治理基础设施,本就长期处于高频攻击目标之下。若AI模型能够更快完成漏洞发现、权限提升、横向渗透与自动化利用,那么智能合约审计、热钱包安全、DevOps流程防护以及供应链安全都将面临更大压力。

从市场角度看,相关消息往往会强化两类叙事:其一,AI安全和网络安全赛道的重要性上升,可能带动与安全基础设施、链上监控、威胁情报相关项目获得更多关注;其二,投资者对中心化平台、托管服务商及大型协议的运营安全要求将进一步提高。一旦AI驱动攻击显著降低攻击成本、提升攻击效率,市场对“代码即风险”的重新定价可能加快。

值得注意的是,英国政府同期发布的年度网络安全漏洞调查显示,过去12个月中,英国有43%企业遭遇过网络入侵或攻击。为此,政府宣布新增9000万英镑资金以提升网络韧性,并推动《网络安全与韧性法案》以保护关键服务。同时,官方还提醒企业,应为AI加速发现和武器化软件漏洞所带来的新一轮风险上升做好准备。

总体来看,GPT-5.5的测试结果释放出一个清晰信号:AI能力的边界正在迅速外扩,而网络攻防正成为最敏感、也最需要治理跟进的前沿领域。对于加密市场参与者而言,未来比拼的不只是创新速度,更是面对AI时代新型攻击面的防御能力。

This article was originally published by Bit.Fan. For more cryptocurrency news and market insights, visit www.bit.fan.
200

Disclaimer:

The market information, project data, and third-party content displayed on this platform are for industry information sharing only and do not constitute any form of investment advice or return commitment.

Cryptocurrency trading carries high risks. Users should fully assess their risk tolerance and make independent decisions. All profits, losses, and legal responsibilities are borne by the users themselves.