谷歌于周二发布 Nano Banana 2.1,这是这款 AI 图像模型的最新版本,可将文字提示生成图片,也可以对现有照片进行编辑。
该模型正陆续上线 Gemini 应用、Google Search 的 AI Mode、Google Ads,以及 Google AI Studio、Flow 和 Stitch 等开发者工具。
原始版本的 Nano Banana 曾推动 Gemini 热度上升。报道称,2025 年 9 月,借助将自拍转换为收藏人偶的功能,Gemini 一度登上两大主要应用商店榜首,结束了 ChatGPT 持续近 3 年的领先地位。
同一时期,Alphabet 的市值突破 3 万亿美元。
Nano Banana 2.1 的主要更新
Version 2 于 2026 年 2 月推出,基于 Gemini 3.1 Flash Image 构建。其一项主要能力是在绘制现实世界的人物或事件前先调用 Google Search,从而提高生成内容与真实信息一致的概率。
对于这次更新,谷歌列出了 3 项升级:
- 视觉设计表现更好;
- 基于蒙版的编辑更精细,即用户标记某个区域后,仅修改该区域;
- 主体一致性更强,也就是一个人物或物体在经过多次编辑后,仍能保持原本外观特征。
谷歌在 X 平台发文称:『Meet Nano Banana 2.1, our latest image generation and editing model 🍌 This upgraded version outperforms our previous models across the board, with notable leaps in visual design, mask-based editing, and subject consistency to help you create more natural-looking images.』
测试得分与生成能力
在文生图测试的总体偏好指标上,Nano Banana 2.1 获得 1,050 ELO Points。作为对比,Nano Banana 2 的得分为 990,Nano Banana Pro 为 935。按照 ELO 体系,分数越高表现越好。报道同时指出,这一体系没有上限,因此属于定性评价。
参数层面,Nano Banana 2.1 一次最多可处理 14 张参考图,可跟踪最多 4 个角色和 10 个物体。输出分辨率最高支持 4K,约相当于电视级清晰度,画面比例最宽可达 8:1。
开发者可调设置与价格变化
开发者还可以设置模型在生成图片前的“思考”时长,从最少到高不等,也可以让模型结合 Google Search 和 Google Image Search 进行结果 grounding。按报道的解释,也就是模型在绘图前可以先检索相关内容。
在 Google 的开发者 API 中,也就是允许其他公司应用接入该模型的接口,生成一张标准 1K 图片的价格为 0.0336 美元。相比 Nano Banana 2 的 0.067 美元,这一价格约下降一半。
生成一张 4K 图片的价格为 0.0756 美元,低于 Nano Banana 2 的 0.151 美元。对于批量任务,也就是一次处理大量图片、而非即时逐张处理的场景,价格还能再打 5 折。
按标准 1K 定价计算,通过 API 生成 1,000 张图片目前约需 33.60 美元,低于 Nano Banana 2 的 67 美元。报道认为,这使得该模型在性能之外,也具备较高的效率和成本优势。

