谷歌正式发布 Nano Banana 2.1,作为 Nano Banana 2 的升级版,继续定位高效率图片生成和编辑模型。新版本的改进主要集中在画质、指令遵循、文字生成,以及多轮交互中的角色一致性。
目前,Gemini、AI Mode、AI Studio、Flow、Stitch 和 Google Ads 等产品已经开始上线这一版本,对应的 API 型号为 gemini-nano-banana-2.1。
图片编辑成为这次升级重点
Nano Banana 2.1 支持 1K、2K 和 4K 输出,最多可以同时使用 14 张参考图,并保持最多 4 个角色和 10 个物体的一致性。谷歌还加强了蒙版编辑能力,也就是只修改指定区域,同时改善了信息图排版、图片文字和超宽画幅生成。
模型现在还可以选择 minimal、medium 和 high 三档思考强度。
谷歌模型卡与 Arena 榜单都显示性能提升
按照谷歌自己的模型卡,开启 thinking 的 Nano Banana 2.1 在文生图、通用编辑、多人一致性、蒙版编辑等全部 10 项评测中,点估计都高于 Nano Banana 2 和 Nano Banana Pro。
独立的 Arena 榜单也给出了类似结果。Nano Banana 2.1 目前在文生图排名第 5,在单图编辑排名第 6,这两项都是 Google 模型中的最高成绩。不过,它仍落后于 GPT Image 2.5 和 GPT Image 2。
图片输出降价,但输入与文字输出成本上升
价格方面,Nano Banana 2.1 的标准 API 图片输出费用反而下降。1K、2K、4K 图片输出价格分别为 0.0336 美元、0.0504 美元和 0.0756 美元,大约只有 Nano Banana 2 的一半。
不过,输入价格从每百万 token 0.50 美元涨到 1.50 美元,文字和 thinking 输出价格也从 3 美元涨到 7.50 美元。参考图数量越多、思考强度越高,图片降价带来的成本优势就会越小。

