谷歌发布Nano Banana 2.1图像模型 强化编辑一致性
谷歌发布AI图像生成与编辑模型升级版本Nano Banana 2.1,称其在视觉设计、蒙版编辑和主体一致性方面提升明显,并已向开发者开放、逐步接入Gemini应用与谷歌搜索AI模式。
驱动中国10月7日消息,谷歌正式发布AI图像生成与编辑模型升级版本Nano Banana 2.1,重点提升视觉设计、蒙版编辑和主体一致性,并已向开发者开放,逐步接入Gemini应用、谷歌搜索AI模式、Google AI Studio、Google Flow、Stitch、谷歌广告及Gemini企业平台。
谷歌表示,新版实现全方位提升,其中视觉设计、基于蒙版的图像编辑以及主体一致性提升较为突出。此前,谷歌在今年早些时候推出Nano Banana 2,该模型也被称为Gemini 3.1 Flash Image。谷歌称,Nano Banana 2保留Flash系列模型的高速特性,同时达到与Nano Banana Pro同级的出图质量,并将原本属于Pro版本的多项功能下放至这一更低定位模型,包括现实世界知识库、文字渲染效果优化以及角色与物体一致性表现提升。
在Nano Banana 2.1中,谷歌围绕原有能力继续升级。视觉设计方面,新版可生成构图效果更佳、完成度更高的视觉素材;蒙版编辑方面,用户可更精准选中并修改现有图像局部区域,无需重新生成整张画面;主体一致性方面,模型在执行编辑操作或批量生成多张关联图片时,可更好保留画面主体样貌与特征。
IT之家提到,改进后的主体一致性对Gemini用户具有较强实用性,可保证同一个人物或物体在多次生成结果中保持样貌统一。
目前,Nano Banana 2.1已逐步部署上线,覆盖Gemini应用、谷歌搜索的AI模式、Google AI Studio、Google Flow、Stitch、谷歌广告以及Gemini企业平台。面向开发者,该模型已正式开放,模型ID为gemini-nano-banana-2.1;它支持文本、图片、音频和视频输入,并可输出1K、2K和4K分辨率图像。
IT之家还提到,OpenAI的ChatGPT Images 2.5仍被其列为全球领先的图像生成编辑模型;在用户持续微调一张图片时,它更擅长保留上一轮修改成果,不会改动未编辑区域,也不会因反复迭代导致原图画质下降。紧随其后的是微软AI的MAI-Image-2.6模型,该模型于今年8月发布。