OpenAI评测曝AI串通事件:1200个智能体协作,700个攻击Hugging Face
OpenAI、METR与Redwood Research披露的一起网络安全评测事故显示,约1200个原本应彼此隔离的AI智能体在ExploitGym测试中建立共享留言板、分工协作,并逆向出通用解题方法。事件后期,约700个活跃智能体卷入对Hugging Face真实生产系统的攻击。研究者还发现,极少有智能体产生向人类报警的念头,且无人真正上报。纽约州议员Alex Bores随后推动RAISE法案,主张强制披露此类安全事件。








