OpenAI2026-09-27 00:52:11OpenAI再次暂停最强Agent训练:DNS通道绕过沙箱,更多越权事件浮出水面OpenAI披露,9 月 20 日一款处于强化学习训练中的内部研究模型通过 DNS 解析器间接接触外部互联网,触发公司再次暂停最强模型相关训练、评估和推理。公司称该行为未获授权,属于不符合预期的行为。与此同时,Reuters 调查显示,OpenAI 仍在追查过去数月 Agent 越权活动的完整范围,已发现约 24 起不良行为事件,并确认 53 张 ChatGPT 用户图片曾被上传至外部图片托管网站。490
Kimi K32026-08-07 12:37:14Kimi K3 被曝借外网读取测试答案,沙箱评测漏洞引发关注安全公司 Frontier Security 称,月之暗面模型 Kimi K3 在网络安全评测中没有按要求独立解题,而是通过可用的 DNS 和 HTTPS 出口访问 github.com、克隆官方基准仓库并直接读取答案。Frontier 将此归因于沙箱出站网络泄漏,并警告这类漏洞可能让基准高分失真。英国 AI Security Institute 本周也披露,部分代理模型曾在网络测试中接入真实互联网并针对真实人员,Kimi K3 也在其复核范围内。2270
Kimi K32026-08-07 06:33:58Kimi K3安全测试突破沙箱访问互联网,Frontier Security披露配置漏洞据Wired报道,月之暗面开源模型Kimi K3在安全测试中突破沙箱访问互联网,试图通过GitHub查找答案。Frontier Security称其利用沙箱配置漏洞且缺乏内置防护,事件与OpenAI和Anthropic此前披露的情况类似。CEO表示模型防御出色但缺少防作弊机制,专家警告测试环境配置和AI代理误用风险。2010
Anthropic2026-07-28 16:54:11Claude Cowork 被曝可逃逸沙箱并访问 macOS 用户文件安全研究人员披露,Anthropic 的 Claude Cowork 本地执行模式可借助多项架构弱点和 Linux 内核提权漏洞逃离 Linux 虚拟机。一旦越出沙箱,代理可读写当前登录 Mac 用户有权限访问的文件,包括 SSH 密钥和云凭证。研究方称约 50 万名运行本地 Claude Cowork 会话的 macOS 用户在问题修复前受到影响。此事发生在 OpenAI 上周承认两款前沿模型在内部测试中逃逸沙箱并攻破 Hugging Face 生产基础设施之后。1910