OpenAI 于美国时间 9 月 10 日宣布,Agents API 进入公开测试,并将支撑 Codex 与 ChatGPT Work 的代理 harness 与基础设施,通过一支 API 向所有开发者开放。
OpenAI 表示,开发者只需在一次 API 调用中指定任务、模型、工具与执行环境,就能建立可上线的云端代理,相关 harness 由 OpenAI 代管与维护。这也是 OpenAI 当天发布的第三项开发者产品,另外两项分别是 GPT-Live-1 语音 API 和 ChatGPT 金融服务版。
执行环境提供三种选择
OpenAI 说明,不同工作负载需要不同的计算、存储与部署选项,Agents API 允许开发者自行选择沙盒环境。
第一种是 OpenAI 托管沙盒,沿用 Codex 与 ChatGPT 使用的同一套沙盒基础设施,由 OpenAI 配置与管理,也可以装入开发者的文件、软件包、技能与插件。
第二种是部署在开发者自己的基础设施上。
第三种是生态伙伴环境。首批合作方包括 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop 与 Vercel。这些方案可提供完全托管或 VPC 内部署,也支持特定的文件与密钥存储机制,以及不同的 CPU、GPU 和内存配置。
提供上下文压缩、工具按需加载与多代理协同
OpenAI 指出,每次新模型上线,往往都意味着要重写 harness,这会占用改进应用本身的时间。Agents API 为这些能力提供版本化访问,harness 会随模型持续维护与更新。
近期加入的能力共有三项。
- 上下文管理:当工作会话接近上下文上限时,系统会自动压缩较早内容,开发者不必自行实现压缩逻辑,工作流程也可以跨越多个上下文窗口。
- 工具搜索与程序化调用:仅在需要时加载相关工具定义,以减少 token 消耗;同时支持程序化工具调用,让代理可以并行执行、串接相关操作,并在代码中筛选与合并结果,支持 MCP、自定义函数和网页搜索等内置工具。
- 多代理支持:可将复杂任务拆分为独立部分,交给并行运行的子代理处理,各自维持独立上下文,再由主代理负责协调和整合结果。
OpenAI 强调,Agents API 由开源的 Codex harness 驱动。开发者可以在公开代码库中查看协调模型调用、工具与上下文的核心逻辑,同时由 OpenAI 负责运营和维护。
公测阶段不额外收费
Agents API 即日起向所有开发者开放公测。OpenAI 表示,不会额外收取服务费,开发者只需支付代理使用的 token 与工具费用,按定价页计算;沙盒容器用量则由环境供应商另行计费。
OpenAI 还表示,公测期间会根据开发者反馈快速迭代,目标是走向正式版,并邀请开发者回报哪些部分运行顺畅、哪些地方存在摩擦,以及在正式环境中构建和运行代理还需要哪些能力。
与此前自主执行任务方向衔接
链新闻此前报道,GPT-6 Astra 于 9 月初发布时,主打自主完成工作。此次 Agents API,则把执行这类长时间任务所需的 harness 与沙盒整理成可租用服务,开发者无需再自行拼接编排框架。

