IT之家 10 月 7 日消息,谷歌在今日推出 Nano Banana 2.1,这是其 AI 图像生成与编辑模型的升级版本。谷歌表示,新版 Nano Banana 2.1 实现了全面改进,尤其是在视觉设计、基于蒙版的图像编辑以及主体一致性方面表现突出。
今年早些时候,谷歌发布了 Nano Banana 2,也称为 Gemini 3.1 Flash Image。Nano Banana 2 兼具谷歌 Flash 系列模型的高速度,同时达到了与 Nano Banana Pro 同等的图像质量。谷歌还将多项原本仅限 Pro 版本的功能下放至这款定位较低的模型,包括现实世界知识库、文字渲染优化,以及角色与物体的一致性提升。
IT之家注意到,Nano Banana 2.1 在原有功能基础上,主要围绕三大方向进行了优化:
改进后的主体一致性对 Gemini 用户非常实用,可确保同一个人物或物体在多次生成结果中保持外貌统一。谷歌 Nano Banana 2.1 现已逐步部署上线,覆盖 Gemini 应用、谷歌搜索的 AI 模式、Google AI Studio、Google Flow、Stitch、谷歌广告以及 Gemini 企业平台。
面向开发者,Nano Banana 2.1 已正式开放,模型 ID 为 gemini‑nano‑banana‑2.1;该模型支持文本、图片、音频及视频输入,并可输出 1K、2K 和 4K 分辨率的图像。
目前,OpenAI 的 ChatGPT Images 2.5 仍是全球领先的图像生成与编辑模型。在用户持续微调一张图像时,它更擅长保留上一轮的修改结果,不会改动未编辑的区域,也不会随着反复迭代降低原图质量。紧随 OpenAI 产品之后的是微软 AI 的 MAI‑Image‑2.6 模型,该模型于今年 8 月发布。