谷歌发布Nano Banana 2.1图像模型 强化蒙版编辑与主体一致性
IT时代网10月7日消息,谷歌今日正式发布AI图像生成与编辑模型的升级版本Nano Banana 2.1,官方称新版实现全方位提升,视觉设计、基于蒙版的图像编辑以及主体一致性三方面进步尤为突出。
今年早些时候,谷歌推出过Nano Banana 2,也称Gemini 3.1 Flash Image。这款模型在保持Flash系列高速特性的同时,实现了与Nano Banana Pro同级别的出图质量,多项原本属于Pro版本的能力也被下放,包括现实世界知识库、文字渲染效果优化以及角色与物体一致性提升。
Nano Banana 2.1的主要改进集中在三个方向:视觉设计上可以生成构图更佳、完成度更高的视觉素材;蒙版编辑允许用户精准选中并修改现有图像的局部区域,无需重新生成整张画面;主体一致性则在编辑操作或批量生成多张关联图片时,更好地保留画面主体的样貌与特征。
改进后的主体一致性对Gemini用户实用性较强,可以保证同一人物或物体在多次生成结果中保持样貌统一。目前Nano Banana 2.1已逐步部署上线,覆盖Gemini应用、谷歌搜索AI模式、Google AI Studio、Google Flow、Stitch、谷歌广告以及Gemini企业平台。面向开发者,该模型同步开放,模型ID为gemini-nano-banana-2.1,支持文本、图片、音频及视频输入,可输出1K、2K以及4K分辨率图像。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。
编辑:林一舟