OpenAI发布 ChatGPT Images 2.5,强化连续修图与参考图一致性

OpenAI发布 ChatGPT Images 2.5,强化连续修图与参考图一致性

N
News Editor
2026-09-09 15:50:47
OpenAI 于美国当地时间 9 月 8 日发布 ChatGPT Images 2.5,新版把重点放在图片编辑、参考图保真和多轮修改一致性上,官方称生成速度最高较 Images 2.0 提升 50%。ChatGPT 同时新增 Sketch、Templates 和图片评论功能,API 侧推出 GPT-Image-2.5 Flare 与 Sunburst。OpenAI 表示,用户目前每周通过 ChatGPT Images 和 API 中的 GPT-Image 模型生成超过 30 亿张图片。

美国当地时间 9 月 8 日,OpenAI 发布最新生图模型 ChatGPT Images 2.5,更新重点集中在图片编辑、参考图保真和多轮修改的一致性。

按照 OpenAI 的说法,用户连续修改同一张图片时,前面已经调整好的内容更容易被保留下来;在修改人物、产品或背景时,模型也更容易只改变指定部分。官方称,生成速度最高比 Images 2.0 快 50%。

这次更新还把 Sketch、Templates 和图片评论功能加入 ChatGPT。用户可以直接画草图作为参考,也可以在图片上标记需要修改的位置。开发者则可通过 API 使用 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst。

OpenAI 表示,目前用户每周通过 ChatGPT Images 和 API 中的 GPT-Image 模型生成超过 30 亿张图片。Images 2.5 已向 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖网页、桌面和移动端。

连续编辑更强调“只改一处”

AI 生图在首张图生成之后,往往更容易暴露问题。人物已经满意,只想换衣服;产品已经确定,只想换背景;海报已经做好,只想改一行字。过去继续修改时,图中其他部分也可能跟着发生变化。

Images 2.5 把精准编辑放在了核心位置。OpenAI 给出的案例包括「全身编辑」和「多城市旅行票」,并用连续图片展示修改过程,观察模型是否能按照指令调整指定内容,同时保留原有主体、构图和其他细节。

其中,「多城市旅行票」更接近日常使用场景。如果只需要改动其中一项信息,模型不仅要识别具体的修改对象,还要维持整张票的设计结构。对产品图、广告素材和品牌海报来说,这类能力比单纯生成一张好看的图片更有实用价值。

多轮编辑也是这次更新的重点。OpenAI 展示了「立方体旋转」「旅行信息图」和「生日蜡烛」三个案例,几组演示都不是生成一次即结束,而是在同一张图上连续进行多次修改。OpenAI 想证明的是,前面的修改能够继续保留,后续操作不会反复破坏已经完成的内容。

这也是 Images 2.5 此次升级最受关注的部分。

X 用户 @thesoragirls 做过一个直接测试:在图片中画出蜡烛,同时指定一片花瓣保持不变,再观察模型修改其他区域时会不会动到原有内容。她给出的测试结果显示,被固定的花瓣得到保留,其他部分则按要求发生变化。

不过,多轮编辑并没有彻底解决细节问题。日本动画制作师 @genel_ai 在实际测试中提到,虽然官方强调多次编辑后画质能够保持,但当编辑不断叠加时,图片仍可能出现锯齿和质感变化。

按现有测试结果看,2.5 在稳定性上有所改善,但复杂场景下仍可能出现画质损失。

参考图处理更稳,复杂构图覆盖更多类型

Images 2.5 的第二个变化,落在参考图片处理上。

用户可以提供人物、宠物或其他主体的照片,再要求模型把它放入新场景、换成另一种视觉风格,或调整构图。OpenAI 称,新版本更容易保留人物的识别特征,同时改善光线和纹理表现。

官方一次给出五个案例,分别是「重新设计的婴儿肖像」「穿着服装的狗」「照相亭头像」「多人派对合成照片」和「整理床铺」。

这几组案例覆盖了不同场景。婴儿肖像和照相亭头像主要看人物特征能否保持;狗的案例关注主体换装后是否还能维持原来的形象;多人派对合成照片涉及多个人物同时进入一张图;「整理床铺」则更接近日常图片编辑,对原始场景进行具体调整。

这类能力对需要长期复用同一人物、产品或品牌素材的工作流较为重要。API 用户可以基于同一张参考图生成多个版本,减少每次重新生成时出现明显变化的情况。

复杂画面也是官方这次展示的重点。OpenAI 展示了一张 20 世纪 50 年代风格的家庭插画:一家人站在巨大的圆柱形太空栖息地前,画面里包含绿色景观、湖泊和未来建筑。

OpenAI 官方介绍页还展示了一个宜昌旅行页面,把旅行目的地、景点信息、图片和文字内容放进同一页面,整体做成一份完整旅行攻略。这类任务需要同时处理多张图片、不同层级的文字和页面布局,不能只把单个元素做好。

另外还有一组九宫格的中世纪现代主义海报,每张海报都带有不同几何图形和文字,包括「Create」「Grow together」「Choose kindness」。

另一张图则是旧金山街道的印象派画面,街道从彩色房屋之间向下延伸,可以看到海湾和金门大桥。

除了这些案例,官方还展示了奶油金色的 Lake Como 婚礼请柬、倒置未来城市、8 张美国国家公园复古邮票、太阳耀斑科普幻灯片、蓝金色地球马赛克、ChatGPT 贴纸海报,以及雨夜未来城市。

这些案例覆盖插画、海报、请柬、信息图、科普图和产品宣传图等多种类型。OpenAI 想展示的核心很明确:当 Prompt 同时规定画面结构、文字、视觉风格和具体元素时,Images 2.5 能更完整地执行这些要求。

时尚创业者雅娜·维兰德(Yana Welinder)在测试后认为,Images 2.5 在时尚设计上的表现有明显提升。她表示,此前使用旧模型时,参考设计虽然能够保留下来,但最终效果有时比较平;在她看来,2.5 能让原本设计呈现出更完整的视觉效果。

也有相反的测试结果。AI 与软件工程师马克·克雷奇曼(Mark Kretschmann)专门进行了森林场景的噪声和伪影测试。

他认为,2.5 虽然有不少改进,但测试结果并不稳定。随后他又把 Images 2.5 和 Images 2.0 做对比,并表示在自己测试的多个案例里,2.0 在真实感方面反而更好。

按目前公开信息,更准确的判断是,Images 2.5 重点改善了编辑控制和复杂指令处理,但在不同图片类型下,实际效果仍有差异。

Sketch、模板和图片标注补进工作流

除了模型本身,OpenAI 还为 ChatGPT 增加了几种新的操作方式。

最直接的是 Sketch。用户可以在 ChatGPT 里直接画草图,再让模型根据草图生成最终图片。比如想设计一个房间,可以先画出大致布局;想做一件衣服,可以先画出轮廓;即便只是一个很粗略的构图,也可以交给 ChatGPT 继续完成,之后再补充视觉风格和其他要求。

使用时输入「@Sketch」即可调用。这种方式降低了对文字 Prompt 的依赖。一些构图很难完全靠语言描述,特别是物体的位置、比例和大致轮廓。现在用户可以先画,再让模型补全。

X 用户 @fquolodasha 在测试后,对 GPT-Image2.5 的手绘能力评价很高,直言这次效果「有点牛」,并提到 OpenAI 近期的更新速度和能力提升都很猛。

Templates 解决的是另一个问题。ChatGPT 新增了一些常见创作格式,例如 Poster 和 Merch。用户先选择模板,再填写想表达的信息、设计元素和视觉风格,不需要每次都从空白画布开始。

图片分享也增加了 Prompt 选项。用户分享图片时,现在可以一并分享生成该图所使用的 Prompt。其他人拿到后,可以换成自己的照片和细节继续生成。

OpenAI 给出的例子是一张 20 世纪 80 年代风格的人像:卷发、彩色夹克、金链、霓虹灯和音乐播放器。其他用户可以沿用这一思路,把自己的照片替换进去。

API 同步开放 Flare 和 Sunburst

Images 2.5 也同步进入 API。OpenAI 推出 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst。

Flare 是默认版本,重点放在速度、质量和编辑能力。OpenAI 称,它比 GPT-Image-2 生成质量更高,同时延迟降低 50%,适合社交内容、产品体验、视觉搜索、快速原型以及大量图片生成。

Sunburst 则更偏向需要精细控制的工作,例如正式广告素材和高质量产品图片。它允许更长的生成时间,以换取更高的编辑精度。

OpenAI 公布的早期用户反馈,也主要集中在编辑控制能力上。

Higgsfield AI 产品负责人阿克苏尔坦·阿利姆库洛夫(Axultan Alimkulov)特别提到,Flare 能较好理解哪些内容应该保持不变。对影视、UGC 和广告团队来说,这意味着修改一个元素时,可以尽量保留原有角色、构图和视觉识别。

连续创业者 @gkxspace 则把这次更新放到商业图片工作流中观察。他表示,过去 AI 生图的主要限制之一,是第一张图可能很好,但很难继续基于它稳定制作第二张、第三张。Images 2.5 在连续编辑、速度和参考图保真上的变化,让电商换装、品牌素材延展和连续插画等场景更接近实际可用。

目前,Images 2.5 已覆盖 ChatGPT、ChatGPT Work 和 Codex 用户,API 中的 Flare 和 Sunburst 也已同步开放。OpenAI 同时保留了提示词和图片安全检查、C2PA 元数据以及不可见水印等机制,用于识别由其工具生成的图片。

从官方案例和现有用户测试看,这次更新的重点很集中:让图片生成后的修改更容易控制,让参考图在连续使用时更稳定,同时把 Sketch、模板和图片标注等操作补进工作流。

至于真实感、细节和多轮编辑后的画质,现有测试已经出现不同结果。Images 2.5 最终能把这些问题改善到什么程度,还需要更多实际使用来验证。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。