千问发布 Qwen-Image-2.1,并公开模型权重。该模型把文生图和图片编辑整合进同一个模型,视觉生成部分为 7B 参数,原生支持 2K 图片和透明背景图片。
编辑能力成为这次升级重点
根据快讯内容,Qwen-Image-2.1 最多可同时输入 10 张参考图,把多个人物或商品重新组合到一张图中。局部修改也可直接通过圈选、涂画或提供蒙版完成,不需要再单独运行一个编辑模型。
支持透明背景输出
Qwen-Image-2.1 还可直接生成带 Alpha 通道的 RGBA 图片,相当于模型直接输出透明背景素材,也可以从照片中提取主体。
首日接入与授权范围
Diffusers、ComfyUI、vLLM-Omni 和 SGLang 已在首日接入,本地工作流无需等待第三方继续适配。
不过,这次「开源」仍有限制。权重虽已公开,但许可证为 Qwen Research License,仅允许非商业研究和评估;商业使用需要另外向千问申请授权。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

