OpenAI 公布的最新内部数据显示,公司去年设定的首个递归自我改进目标已经完成:原定于 2026 年 9 月打造的「AI 研究实习生」已提前达成。
按 OpenAI 去年的规划,公司有两个阶段性目标:一是在 2026 年 9 月造出「AI 研究实习生」,二是在 2028 年 3 月造出真正的自动 AI 研究员。现在,第一个目标已被确认完成。
Agent 已能独立处理部分研究任务
OpenAI 表示,在人类研究员给出明确研究问题后,Agent 已经能够独立完成一些原本需要熟练研究员花几天时间处理的任务。研究员也越来越常把任务交给 Agent。
8 月中旬运行时长折算为人工的 3.1 倍
截至 8 月中旬,按研究部门总量折算,人类每工作 8 小时,多个 Agent 合计会运行约 24.8 小时,相当于 3.1 个 Agent 工作日。OpenAI 同时说明,这里统计的是运行时长,并不代表研发效率直接提高了 3.1 倍。
在今年 6 月以前,Agent 的总运行时间还低于人类;到 8 月中旬,这一情况已经发生变化。
承担任务变长,实验数量创统计以来新高
年初时,Agent 主要承担研究代码和基础设施代码相关工作。现在,它们已经开始负责实验监控等更长、也更复杂的任务。
OpenAI 还披露,8 月每名活跃实验者运行的实验数量,创下公司开始统计以来的新高。
研究方向仍由人来定,人工介入仍然常见
不过,研究方向目前依然由人类决定。Agent 很少负责高层研究规划。过去半年里,即使是成功完成的 4 到 8 小时任务,超过一半也至少需要一次人工介入。
OpenAI 的下一步目标,是在 2028 年 3 月把当前的「实习生」升级为能够完成更完整研究工作的自动 AI 研究员。

