谷歌发布 Nano Banana 2.1 图像模型,视觉设计与蒙版编辑能力升级
摘要
谷歌正式推出 AI 图像模型 Nano Banana 2.1,在视觉设计、蒙版编辑和主体一致性三方面实现改进。该版本已逐步上线 Gemini,可精准修改局部图像并保持多图主体样貌统一。
谷歌于 10 月 7 日发布了 AI 图像生成与编辑模型 Nano Banana 2.1,作为此前 Nano Banana 2 的升级版本。谷歌表示,新模型实现了全方位提升,其中视觉设计、基于蒙版的图像编辑以及主体一致性三方面的进步尤为显著。
回顾今年早些时候,谷歌推出了 Nano Banana 2,该模型也被称为 Gemini 3.1 Flash Image。它在保留谷歌 Flash 系列高速特性的同时,达到了与 Nano Banana Pro 同级别的出图质量。谷歌还将多项原本属于 Pro 版本的功能下放至这款定位更低的模型,包括现实世界知识库、文字渲染效果优化,以及角色与物体的一致性表现提升。
Nano Banana 2.1 在原有能力基础上主要围绕三大方向做出改进。视觉设计方面,模型可以生成构图效果更佳、完成度更高的视觉素材。蒙版编辑方面,用户能够更精准地选中并修改现有图像的局部区域,无需重新生成整张画面。主体一致性方面,在执行编辑操作或批量生成多张关联图片时,模型可以更好地保留画面主体的样貌与特征。
改进后的主体一致性对 Gemini 用户而言实用性较强,能够保证同一个人物或物体在多次生成结果中保持样貌统一。目前,谷歌 Nano Banana 2.1 已逐步部署上线,覆盖 Gemini 平台。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗