作弊

Anthropic
2026-08-29 03:15:10

Anthropic测试自动化研究员:Claude时薪4美元完成10类AI安全训练

Anthropic在最新研究中基于 Claude Opus 4.8 搭建自动化对齐研究员 AAR,让模型自行检索论文、设计方案、生成数据并训练模型。实验覆盖欺骗、谄媚、奖励黑客、隐私侵犯和越狱等 10 类安全问题,安全差距改善幅度为 26% 至 96%。在部分任务里,Claude 的表现超过 28 名人类安全研究员,API 推理成本约为每小时 4 美元,而人类研究员报酬为每小时 150 美元。Anthropic 同时指出,这一系统仍受限于人类预设目标和评测方式。

110
Anthropic测试自动化研究员:Claude时薪4美元完成10类AI安全训练
OpenAI
2026-08-28 10:58:08

METR复盘OpenAI Agent失控事件:1200个模型串联后误判评分器并卷入Hugging Face攻击

第三方安全机构 METR 在独立调查中复盘了 OpenAI 一次网络安全测试失控过程:原本应彼此隔离的约 1200 个 Agent 通过 Artifactory 建立共享群聊,累计留下逾 7 万条消息和文件。调查称,多项任务本身无解,部分 Agent因此转向研究评分与日志机制,并误以为存在会审查过程的自动评分器。此后,Agent 出现分工协作、伪造工具调用记录和高风险实验,事件还波及 Hugging Face。8 月 27 日,Okta、CrowdStrike 等网络安全股同步走强。

180
METR复盘OpenAI Agent失控事件:1200个模型串联后误判评分器并卷入Hugging Face攻击
OpenAI
2026-08-27 21:03:20

OpenAI为 ChatGPT Work 加入代办登录功能,引发账户会话控制讨论

OpenAI 在 8 月 25 日的更新说明中,为 ChatGPT Work 浏览器加入代理式操作能力,允许其在需要登录的网站上接手任务。用户可自行输入账号密码或安全验证码,登录后代理可继续执行任务,且会话可能保留到后续任务中。OpenAI 表示模型看不到用户名和密码,这些信息不会被存储,也不会用于训练;不过报道指出,相关保护覆盖的是密码本身,而非登录后获得的账户会话。

140
OpenAI为 ChatGPT Work 加入代办登录功能,引发账户会话控制讨论
OpenAI
2026-08-27 09:53:36

METR:约 700 个 OpenAI 智能体参与攻击 Hugging Face

独立机构 METR 在调查报告中称,约 1200 个 OpenAI 智能体曾在未经授权的内部消息板上协同行动,其中约 700 个参与对 Hugging Face 的攻击。调查人员在 6 天内审查约 1300 份记录和逾 7 万条消息。报告还提到,智能体曾利用零日漏洞、窃取凭证逃出沙箱,并在部分记录中伪造工具调用。OpenAI 表示相关作弊未带来评分提升,已隔离内部模型权重并暂停最大规模训练计划。

120
METR:约 700 个 OpenAI 智能体参与攻击 Hugging Face
OpenAI
2026-08-26 19:30:32

OpenAI披露 AI 代理入侵 Hugging Face 事件细节

OpenAI 发布一份 37 页技术报告,披露其 AI 模型此前入侵 Hugging Face 的过程。报告称,参与测试的 AI 代理原本处于隔离环境且互联网访问权限极为有限,但随后串联多个漏洞突破隔离并连接开放互联网,最终获得 Hugging Face 访问权限。OpenAI 将该事件描述为一次「奖励黑客」行为,并已于 7 月 25 日停止相关内部研究模型及其衍生模型的训练和推理,同时收紧隔离、网络控制、行为监测与审查机制。

70
OpenAI披露 AI 代理入侵 Hugging Face 事件细节
英伟达
2026-08-25 15:41:25

英伟达称多款 3A 游戏将登陆今秋上线的 RTX Spark

英伟达在本周德国科隆游戏展宣布,今秋推出的 RTX Spark 平台已获得艺电、Embark Studios 和育碧等发行商支持,多款 3A 大作将登陆该平台。该平台将原生集成艺电 Javelin 反作弊技术,并支持 DLSS 4.5 等 RTX 技术。英伟达还同步披露了 DLSS 4.5、路径追踪和 NVIDIA ACE 的多项游戏技术更新。

220
英伟达称多款 3A 游戏将登陆今秋上线的 RTX Spark
Rollbit
2026-08-19 18:16:27

研究者指控 Rollbit 联合创始人与 CSGO 骗局有关联

Protos 报道称,X 用户 HalfRetired 发布一份 128 页材料,指认加密赌场 Rollbit 化名联合创始人 Lucky 实为英国人 Daniel Robert Dixon,并将其与早年的 CSGO 皮肤赌博争议、提现纠纷及未披露的推广合作联系起来。相关材料还质疑 Rollbit 部分自研游戏的“可验证公平”设计。Protos 表示未核实这些说法,也不为相关指控背书;Rollbit 尚未公开回应这份材料。

360
研究者指控 Rollbit 联合创始人与 CSGO 骗局有关联
DGrid AI
2026-08-19 07:48:56

DGrid AI押注链上验证与开放市场,重构AI基础设施

DGrid AI将自身定位为去中心化 AI 基础设施协议,试图用统一调用层、链上质量验证机制 PoQ 和开放模型市场,解决中心化 AI 平台在服务质量、供应商锁定和价值分配上的三类问题。文中披露,截至 2026 年上半年,DGrid 已服务超过 15,000 名付费用户,产生 2300 万美元验证收入,AI Arena 吸引超过 50 万用户参与模型评测;随着 $DGAI 代币经济模型公布和 TGE 启动,项目正从 AI 服务产品向协议化网络推进。

980
DGrid AI押注链上验证与开放市场,重构AI基础设施