千问开源 Qwen-Image-2.1,7B 模型支持生成、编辑与透明图

千问开源 Qwen-Image-2.1,7B 模型支持生成、编辑与透明图

N
News Editor
2026-09-20 13:08:42
千问发布 Qwen-Image-2.1 并公开模型权重,将文生图与图片编辑合并进同一 7B 模型。该模型原生支持 2K 图片和透明背景图片,最多可同时输入 10 张参考图,并支持圈选、涂画或蒙版进行局部修改。Diffusers、ComfyUI、vLLM-Omni 和 SGLang 已在首日接入,但其许可证目前仅允许非商业研究和评估,商业使用仍需单独申请授权。

千问发布 Qwen-Image-2.1,并公开模型权重。该模型把文生图和图片编辑整合进同一个模型,视觉生成部分为 7B 参数,原生支持 2K 图片和透明背景图片。

编辑能力成为这次升级重点

根据快讯内容,Qwen-Image-2.1 最多可同时输入 10 张参考图,把多个人物或商品重新组合到一张图中。局部修改也可直接通过圈选、涂画或提供蒙版完成,不需要再单独运行一个编辑模型。

支持透明背景输出

Qwen-Image-2.1 还可直接生成带 Alpha 通道的 RGBA 图片,相当于模型直接输出透明背景素材,也可以从照片中提取主体。

首日接入与授权范围

Diffusers、ComfyUI、vLLM-Omni 和 SGLang 已在首日接入,本地工作流无需等待第三方继续适配。

不过,这次「开源」仍有限制。权重虽已公开,但许可证为 Qwen Research License,仅允许非商业研究和评估;商业使用需要另外向千问申请授权。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。