英国政府下属研究机构人工智能安全研究所(AISI)最新发布的评估报告显示,OpenAI新模型GPT-5.5在进攻性网络安全能力上已跻身当前最强梯队,整体表现大致接近Anthropic的Claude Mythos。这项研究再次表明,先进大模型不仅在通用推理和代码生成方面持续突破,其在网络攻击、漏洞利用和自动化渗透等高风险场景中的能力,也正在以更快速度提升。
复杂企业网络攻击模拟中完成关键突破
根据AISI披露的数据,GPT-5.5成为该机构测试中第二个成功完成最高难度任务的模型。该任务名为“The Last Ones”,是一项包含32个步骤的企业网络攻击模拟。在10次尝试中,GPT-5.5有2次能够自主完成整套攻击链;而此前率先达到这一里程碑的是Claude Mythos Preview,其成功率为10次中的3次。
这一模拟由AISI与网络安全公司SpecterOps联合设计,要求模型以代理方式串联多个高复杂度环节,包括侦察、凭证窃取、在多个Active Directory森林中横向移动、通过CI/CD流水线进行供应链渗透,最终导出受保护的内部数据库。AISI估计,若由人类安全专家手工执行,整个过程大约需要20小时。
逆向工程测试中大幅领先人工耗时
报告中最受关注的结果之一,来自一项极具挑战性的逆向工程谜题。GPT-5.5完成该任务仅用时10分22秒,API调用成本约为1.73美元。相比之下,一名使用专业工具的人类安全专家完成同样挑战,大约需要12小时。
这道题目的难点在于,模型必须先重建一个定制虚拟机的指令集,再从零编写反汇编器,并通过约束求解恢复加密密码。换言之,这并非简单的脚本生成任务,而是对推理、编程、逆向和自动化执行能力的综合考验。GPT-5.5在该项测试中的表现,显示出先进模型正越来越接近承担完整攻防任务链中的高价值环节。
专家级网络任务整体通过率继续攀升
在AISI设置的一系列高级网络安全测试中,GPT-5.5在最高难度“Expert”级别上的平均通过率达到71.4%,略高于Claude Mythos Preview的68.6%,并明显领先GPT-5.4的52.4%。从代际对比来看,这说明模型在短时间内已出现显著跃升,而这种跃升并不局限于单一厂商或单一架构。
AISI在报告中指出,GPT-5.5的表现意味着,AI网络攻击能力的快速增强,可能不是孤立事件,而是伴随推理、编程和自主任务执行能力全面提升而产生的普遍趋势。如果这一判断成立,那么相关能力未来很可能还会在较短周期内继续增强。
安全护栏被“越狱”绕过,监管警报升温
相比能力提升,更令外界担忧的是安全防线的可靠性。研究人员在评估中发现了一种可被广泛复用的通用越狱方法,能够绕过GPT-5.5的安全护栏,并在所有被测试的恶意网络安全请求中诱导模型输出有害内容,甚至在多轮代理式任务环境中依然有效。
据AISI介绍,这一攻击方式由专家红队耗时6小时开发完成。OpenAI随后更新了其安全防护堆栈,但由于配置问题,AISI未能验证最终版本是否已经彻底修复相关漏洞。这意味着,先进模型即便拥有表面上的安全限制,也可能在对抗性提示和系统级操控下暴露出明显缺口。
不过,AISI也强调,本次能力评估是在受控研究环境中进行,并不完全等同于普通用户在公开产品中可直接获得的能力。现实世界部署通常还会叠加额外访问控制、使用限制和防护措施,因此实验结果不应被简单理解为“任何用户都可立即复现”。
对加密行业与市场的潜在影响
对于加密货币行业而言,这类研究的现实意义尤其突出。交易所、跨链桥、托管平台、DeFi协议和DAO治理基础设施,本就长期处于高频攻击目标之下。若AI模型能够更快完成漏洞发现、权限提升、横向渗透与自动化利用,那么智能合约审计、热钱包安全、DevOps流程防护以及供应链安全都将面临更大压力。
从市场角度看,相关消息往往会强化两类叙事:其一,AI安全和网络安全赛道的重要性上升,可能带动与安全基础设施、链上监控、威胁情报相关项目获得更多关注;其二,投资者对中心化平台、托管服务商及大型协议的运营安全要求将进一步提高。一旦AI驱动攻击显著降低攻击成本、提升攻击效率,市场对“代码即风险”的重新定价可能加快。
值得注意的是,英国政府同期发布的年度网络安全漏洞调查显示,过去12个月中,英国有43%企业遭遇过网络入侵或攻击。为此,政府宣布新增9000万英镑资金以提升网络韧性,并推动《网络安全与韧性法案》以保护关键服务。同时,官方还提醒企业,应为AI加速发现和武器化软件漏洞所带来的新一轮风险上升做好准备。
总体来看,GPT-5.5的测试结果释放出一个清晰信号:AI能力的边界正在迅速外扩,而网络攻防正成为最敏感、也最需要治理跟进的前沿领域。对于加密市场参与者而言,未来比拼的不只是创新速度,更是面对AI时代新型攻击面的防御能力。

