Techub News 消息,全球网络安全联盟(GCSA)今日宣布,其 GCSA Agent 在 CyberGym 基准测试中取得 91.3% 的成功率,位列该测试的「领先系统(成功率超 90%)」类别。
CyberGym 是由加州大学伯克利分校研究团队开发的大规模真实世界网络安全评估框架,包含来自 188 个主要软件项目的 1507 个历史真实漏洞测试案例。
测试要求覆盖完整漏洞分析流程
这项基准测试要求 AI 代理在真实的易受攻击代码环境中工作,仅凭漏洞描述和未修补的代码库,自主完成代码分析、定位漏洞、构建概念验证(PoC)并执行验证。
GCSA Agent 基于 Grok 4.5 和 Grok 4.6 模型运行。GCSA 表示,这一结果显示出 AI 在端到端安全分析流程上的能力。
研究提到开放式漏洞研究进展
CyberGym 的研究还显示,这类代理的安全能力不只限于复现已知漏洞。在开放式漏洞研究实验中,AI 代理已识别出多个此前未知的零日漏洞,以及未能完全解决底层漏洞的历史安全补丁,显示出自主漏洞分析技术正从复现已知漏洞向发现真实漏洞演进的潜力。
该消息引述自 BeInCrypto。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

