Techub News 消息,阿里巴巴旗下通义千问团队发布 Qwen-Image-2.1。这是一款统一的文生图与图像编辑模型。
据介绍,该模型的视觉生成组件包含 70 亿参数,一个检查点即可覆盖文生图、多参考图编辑、局部编辑以及透明 RGBA 输出等功能。模型默认支持 2K 分辨率,并具备原生透明图像生成与多参考图编辑能力。
目前,Qwen-Image-2.1 已支持 Diffusers、ComfyUI、vLLM-Omni 等框架,用于研究与评估;如需商业部署,则需单独向通义千问申请许可。
根据通义千问团队在内部基准 Qwen-Image-Bench 上的测试,Qwen-Image-2.1 的综合得分为 60.28,高于其他已列出的开源权重模型。消息源注明为 MarkTechPost。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

