OpenAI 于 8 月 21 日宣布,GPT-Image-2 在 API 中开放透明背景生成预览。开发者只要在请求里把 background 设为 transparent,模型就会输出带 alpha 通道的图片,可直接叠加到不同底色的版面中。
OpenAI Developers 在 X 平台写道:「Transparent backgrounds are now available in preview for GPT-Image-2 in the API. Generate reusable assets you can place on any background—for product imagery, graphic design, website mockups, and marketing campaigns.」
对需要大量产出素材的团队来说,透明背景不是边缘功能,而是决定图片能否直接投入使用的一道工序。主图之外的区域如果是真正透明,而不是白底,后续排版时就不必再做一次去背处理。
这项能力在 GPT-Image-2 上缺席了约 4 个月
GPT-Image-2 于 4 月 21 日发布,并在 5 月初向开发者开放。该模型在文字渲染和多图生成方面较上一代有提升,但发布后一直不支持透明背景。
在此前的 API 设置中,background 只接受 auto 和 opaque 两个值,若传入 transparent,请求会被 API 直接拒绝。OpenAI 当时也在开发者说明页中明确写明,这个模型不支持透明背景。
相比之下,上一代的 gpt-image-1 自 2025 年 4 月上线起就具备这项能力。对升级到 GPT-Image-2 的开发者而言,这意味着他们在获得更好画质和排版能力的同时,也失去了一项旧模型原本就有的功能。
过去几个月,开发者只能用替代方案补位
在 GPT-Image-2 原生不支持透明背景的情况下,开发者社区主要采用了 4 种处理办法。
- 第一种是降级到仍保留透明背景能力的旧模型,例如 gpt-image-1.5 或 sora_image,以画质换功能。
- 第二种是在 GPT-Image-2 后串接独立去背模型。文中提到的方案包括 RemBG、BiRefNet 和 851-labs 的 background-remover,但每张图会额外增加 1 到 3 秒处理时间。
- 第三种是使用绿幕思路,让模型生成纯绿色背景,再通过色彩门槛去掉背景;但当主体边缘出现绿色反光时,效果容易失真。
- 第四种是让同一张图在两种不同底色下各生成一次,再通过相减计算透明度。这样会把生成成本直接提高到原来的 2 倍。
按照文中列出的定价,GPT-Image-2 按分辨率收费:1K 约 0.03 美元、2K 约 0.05 美元、4K 约 0.08 美元。若按 token 计算,一张 1024×1024 图片从低质量的 272 个 token 到高质量的 4,160 个 token 不等,输出端每百万 token 收费 30 美元。
对于每天需要产出 1,000 张素材的团队,若每张图仅因额外去背多等待 2 秒,累计下来就是 30 多分钟的纯处理时间;若采用双图相减的办法,当天的生图预算则会直接翻倍。
预览版已上线,但仍有限制
这次开放的是预览版本,不是正式版。首批测试者在开发者社群反馈,输出图片的 alpha 值会停在 253 到 254 之间,而不是完全不透明的 255;在透明区域与主体交界处,还可能出现一圈淡灰色光晕。
另一个问题出现在 edit 端点。测试者称,当输入本身就带有透明度的图片时,edit 端点可能无法保留原有透明信息。
输出格式方面也有限制。若要使用透明背景,目前只能选择 PNG 或 WebP,JPEG 不支持该功能。
OpenAI 目前没有说明预览期间是否存在计价差异,也未披露相关用量上限。

