阿里通义千问发布 Qwen-Image-2.1,支持文生图与图像编辑

阿里通义千问发布 Qwen-Image-2.1,支持文生图与图像编辑

N
News Editor
2026-09-21 16:44:23
阿里巴巴旗下通义千问团队发布统一图像生成与编辑模型 Qwen-Image-2.1。该模型的视觉生成组件含 70 亿参数,单一检查点可覆盖文生图、多参考图编辑、局部编辑和透明 RGBA 输出。模型已支持 Diffusers、ComfyUI、vLLM-Omni 等框架,默认支持 2K 分辨率,商业部署需另行申请许可。

Techub News 消息,阿里巴巴旗下通义千问团队发布 Qwen-Image-2.1。这是一款统一的文生图与图像编辑模型。

据介绍,该模型的视觉生成组件包含 70 亿参数,一个检查点即可覆盖文生图、多参考图编辑、局部编辑以及透明 RGBA 输出等功能。模型默认支持 2K 分辨率,并具备原生透明图像生成与多参考图编辑能力。

目前,Qwen-Image-2.1 已支持 Diffusers、ComfyUI、vLLM-Omni 等框架,用于研究与评估;如需商业部署,则需单独向通义千问申请许可。

根据通义千问团队在内部基准 Qwen-Image-Bench 上的测试,Qwen-Image-2.1 的综合得分为 60.28,高于其他已列出的开源权重模型。消息源注明为 MarkTechPost。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。