OpenAI 于 18 日推出两款轻量模型 GPT-5.4 Mini 与 GPT-5.4 Nano,产品定位都不是旗舰模型,而是面向混合 AI 系统中的执行层。按官方说法,这类模型以部分精确度交换更高速度和更低成本,服务对象是由更强模型统一调度、再由大��小模型并行完成任务的多代理架构。
GPT-5.4 Mini瞄准通用执行层
这次发布中的核心产品是 GPT-5.4 Mini。OpenAI 表示,该模型推理速度较前代提升 2 倍,同时在代码生成、多模态理解和工具调用等能力上升级。在基准测试中,Mini 在 SWE-Bench Pro 达到 54.4%,在 OSWorld-Verified 达到 72.1%。
功能上,GPT-5.4 Mini 支持文本与图片混合输入,也支持工具调用、网络与文件搜索,以及电脑操作 UI 交互,覆盖代码助手、IDE 集成、代码审查、截图解读、电脑使用子代理和需要实时响应的交互系统等场景。价格方面,其输入费用为 每百万 token 0.75 美元,输出为 4.50 美元。目前已在 ChatGPT 免费层、Go 订阅层、Codex 和 OpenAI API 上线,也可通过 Azure AI Foundry 部署。
GPT-5.4 Nano主打高吞吐与低延迟
相比 Mini,GPT-5.4 Nano 的定位更聚焦。OpenAI 将其称为当前最小、最具成本效益的模型,目标场景是对延迟极为敏感、又需要大规模并行处理的任务。在测试数据上,Nano 的 SWE-Bench Pro 为 52.4%,OSWorld 为 39.0%,成绩低于 Mini,但定价更低。
Nano 支持指令跟随、函数调用、基础代码、图片理解、分类和数据提取,适合结构化任务,不支持复杂桌面操作或深度推理。其输入价格仅为 每百万 token 0.20 美元,输出为 1.25 美元,约为 Mini 的四分之一。OpenAI 给出的应用方向包括分类与数据提取、代码子代理支持、高量自动化、请求路由、表单处理和客服工作流。该模型目前仅开放 API 访问,不会出现在 ChatGPT 界面。
两款模型都围绕“子代理”设计
OpenAI 将这次发布概括为“为子代理时代而生”。按其产品逻辑,旗舰模型如 GPT-5 或 o 系列负责高层规划与复杂判断,网页抓取、数据转换、表单填写、代码片段生成这类重复性更强的子任务,则交给更小、更快、成本更低的模型并行处理。GPT-5.4 Mini 与 Nano 的工具调用和电脑操作能力,也正是围绕这一系统分工配置。

