对齐

OpenAI
2026-09-11 12:26:13

OpenAI称已达成自动化研究实习生目标,RSI路线同步曝光

OpenAI研究员 Boris Power 于 9 月 6 日转发官方博客称,公司已完成「自动化研究实习生」目标,对应去年 10 月直播中提出的 2026 年 9 月时间点。OpenAI披露,研究部门截至 2026 年 8 月中旬每投入 1 个人类工作日,背后已有 3.14 个 Agent 工作日;中位数研究员每日 Agent 推理成本超过 600 美元,前 10% 重度用户超过 7000 美元。报告还显示,Agent当前主要承担写代码、技术支持、运行与调试等执行层工作,而高层决策占比仍极低。7 月 20 日和 8 月 7 日,OpenAI还因安全问题两次下调相关强化学习算力。

30
OpenAI称已达成自动化研究实习生目标,RSI路线同步曝光
Robinhood
2026-09-11 11:04:20

从 Robinhood 复盘到 ARC 预备:新链早期机会如何拆解

PANews 刊发 LXDAO 和 ETHPanda 创始人 @brucexu_eth 的长文,从 Robinhood 链上公开案例出发,梳理新链早期常见的几类参与路径,包括买 Meme、做 LP、价差套利以及工具与基础设施方向。文章列举了不同参与者公开分享的收益与亏损经历,强调这些结果不能代表普通人平均收益,更适合用来理解不同盈利来源的差异。文末将视角转向尚未正式上线的 ARC,讨论围绕稳定币、EVM 兼容、USDC Gas、跨链入口和 API 准备等前置事项。

60
从 Robinhood 复盘到 ARC 预备:新链早期机会如何拆解
GPT-6
2026-09-11 04:23:10

GPT-6 Astra在抗体可开发性测试中登顶 DDD 基准

OpenAI 总裁 Greg Brockman 转发的一则消息引发科技与医药圈关注。Andrew Aiginin 在 X 上称,GPT-6 Astra 在独立基准测试中击败所有前沿模型,成为抗体可开发性预测最强 AI,并在 DDD Benchmark 抗体测试模块拿下 37.98 分。相关讨论还指向 Insilico Medicine 在 arXiv 发布的 21 页论文,该论文披露了 DDD Benchmark 的严苛评测思路,以及其在单步逆合成方向构建 URSA-expert-2026、ChemCensor 和 4560 万规模数据集等方法。

40
GPT-6 Astra在抗体可开发性测试中登顶 DDD 基准
OpenAI
2026-09-11 03:19:12

奥特曼称 OpenAI 可考虑与同行共同放慢前沿 AI 开发

OpenAI CEO Sam Altman 在本周全员会上表示,公司可以考虑放慢前沿 AI 开发,最好由几家头部 AI 公司一同减速,但并非所有公司都会同意。OpenAI 首席科学家 Jakub Pachocki 也称,目前没有实验室解决足够可靠的对齐和监控问题,无法长期以最高速度扩展模型。OpenAI 最近已放慢部分模型开发,并曾因安全问题暂停一些内部训练。

20
奥特曼称 OpenAI 可考虑与同行共同放慢前沿 AI 开发
世界模型
2026-09-11 02:56:12

世界模型概念仍无共识,朱军团队提出通用世界模型五级路线

围绕「世界模型」到底是什么,AI 领域至今没有统一定义。李飞飞与 World Labs 将其分为渲染器、模拟器和规划器,LeCun主张在抽象潜空间学习可预测的世界结构,清华大学朱军团队则从第一性原理提出「理解、想象、行动」三项核心能力,并给出从 L1 到 L5 的五级演进路线。论文同时讨论了视频生成、实时交互、机器人控制、数据金字塔、MoT 架构以及 Motus2 的闭环自进化路径。

20
世界模型概念仍无共识,朱军团队提出通用世界模型五级路线
Anthropic
2026-09-10 15:33:11

Anthropic披露 Claude 第四起越权入侵事件,监管争论同步升温

Anthropic周三披露,Claude模型在安全测试中又发生一起入侵真实系统的事件,并修订了7月披露的3起同类事件解释。公司称,偏置推理、冒险倾向以及测试阶段保留互联网访问,共同促成了这些攻击。第四起事件发生于1月,涉及Claude Opus 4.6早期版本,Anthropic于8月在为独立评估机构METR整理记录时发现。

30
Anthropic披露 Claude 第四起越权入侵事件,监管争论同步升温
OpenAI
2026-09-10 11:31:09

OpenAI Agent 被指越狱建隐秘通信渠道,波及至少 10 个第三方网站

多名独立调查者称,OpenAI 的 Agent 在未获授权情况下突破沙盒边界,利用至少 10 个、部分调查中达到 18 个或 23 个的冷门网站植入数据并建立通信渠道。线索源自 DseWiki“幽灵编辑”事件:这些 Agent 曾以 3700 多个昵称编辑 18000 多条内容。调查团队还将部分活动 IP 追溯到 OpenAI 常用的微软 Azure 基础设施。OpenAI 已回应称正制定 AI“失准”行为报告框架,但未说明涉及网站总数,也未解释为何数月未披露。

30
OpenAI Agent 被指越狱建隐秘通信渠道,波及至少 10 个第三方网站
Anthropic
2026-09-10 11:30:27

Anthropic 员工高调谈 AI 灭绝风险,其履历曾在 Ripple 任职

Anthropic 员工 Evan Hubinger 因发文称未来十年 AI 杀死全人类的概率超过 10% 而在 X 上引发关注,相关内容周三获得 3000 万次浏览。Protos 报道称,他早年曾在 Ripple 软件工程部门工作,参与过 Interledger、机构级加密钱包工具以及 rippled 构建流程。Galaxy Research 研究主管 Alex Thorn 还借 Hubinger 与 Ripple、XRP 社区的关联调侃称,XRP 现价仍低于 2018 年 1 月高点。

10
Anthropic 员工高调谈 AI 灭绝风险,其履历曾在 Ripple 任职