千问开源 Qwen-Image-2.1,7B 模型支持生成、编辑与透明图
千问发布 Qwen-Image-2.1 并公开模型权重,将文生图与图片编辑合并进同一 7B 模型。该模型原生支持 2K 图片和透明背景图片,最多可同时输入 10 张参考图,并支持圈选、涂画或蒙版进行局部修改。Diffusers、ComfyUI、vLLM-Omni 和 SGLang 已在首日接入,但其许可证目前仅允许非商业研究和评估,商业使用仍需单独申请授权。

千问发布 Qwen-Image-2.1 并公开模型权重,将文生图与图片编辑合并进同一 7B 模型。该模型原生支持 2K 图片和透明背景图片,最多可同时输入 10 张参考图,并支持圈选、涂画或蒙版进行局部修改。Diffusers、ComfyUI、vLLM-Omni 和 SGLang 已在首日接入,但其许可证目前仅允许非商业研究和评估,商业使用仍需单独申请授权。

苹果于 9 月 14 日随 iOS 27 推出 Siri AI,首批仅提供英文 beta 版,用户需加入候补名单,欧盟与中国市场暂不支持。根据 Bloomberg 报道,苹果每年向谷歌支付约 10 亿美元,租用为 Siri 定制的 1.2 兆参数 Gemini 模型,并运行在苹果自有私有云架构上。该功能支持跨设备连续对话、屏幕感知和部分第三方应用联动,但中文目前仍未上线。

OpenAI 于美国当地时间 9 月 8 日发布 ChatGPT Images 2.5,新版把重点放在图片编辑、参考图保真和多轮修改一致性上,官方称生成速度最高较 Images 2.0 提升 50%。ChatGPT 同时新增 Sketch、Templates 和图片评论功能,API 侧推出 GPT-Image-2.5 Flare 与 Sunburst。OpenAI 表示,用户目前每周通过 ChatGPT Images 和 API 中的 GPT-Image 模型生成超过 30 亿张图片。

微软AI推出MAI-Image-2.6-Flash加速模型,在Microsoft Foundry开放公共预览。该模型生图速度达GPT-Image-2 Medium的2.8倍,GPU效率提升72%,同时保持画质竞争力。在Artificial Analysis评测中,图片编辑排第三,文生图排第八。定价每百万token 19美元,折合每千张约19.5美元,远低于GPT Image 2 high的211美元。

BuzzFeed在SXSW发布AI应用BF Island与Conjure,试图借此缓解经营压力并开辟新收入,但现场反应冷淡。市场更关注其用户留存、产品差异化与商业化前景。

BuzzFeed在SXSW发布AI应用BF Island与Conjure,试图借新公司Branch Office开辟收入来源。但在巨额亏损与流动性压力下,产品演示反响平淡,市场更关注其真实需求、留存能力与商业化前景。

AI图像应用Mixup即将全球上线,以“食谱”模板替代复杂提示词,基于谷歌Nano Banana技术,主打更透明、更易上手的创作体验,或推动生成式AI走向大众化。

多款免费AI图片编辑工具进入自然语言修图时代。评测显示,Nano Banana胜在角色一致性,Reve强于创意和网页检索,Qwen Omni Flash更适合多元素合成。
