谷歌发布Nano Banana 2.1图像模型 强化编辑一致性

AI 驱动中国 许棠 226次阅读
分享 微 Q 信
AI摘要
由 AI 生成 · 仅供参考

谷歌发布AI图像生成与编辑模型升级版本Nano Banana 2.1,称其在视觉设计、蒙版编辑和主体一致性方面提升明显,并已向开发者开放、逐步接入Gemini应用与谷歌搜索AI模式。

驱动中国10月7日消息,谷歌正式发布AI图像生成与编辑模型升级版本Nano Banana 2.1,重点提升视觉设计、蒙版编辑和主体一致性,并已向开发者开放,逐步接入Gemini应用、谷歌搜索AI模式、Google AI Studio、Google Flow、Stitch、谷歌广告及Gemini企业平台。

谷歌表示,新版实现全方位提升,其中视觉设计、基于蒙版的图像编辑以及主体一致性提升较为突出。此前,谷歌在今年早些时候推出Nano Banana 2,该模型也被称为Gemini 3.1 Flash Image。谷歌称,Nano Banana 2保留Flash系列模型的高速特性,同时达到与Nano Banana Pro同级的出图质量,并将原本属于Pro版本的多项功能下放至这一更低定位模型,包括现实世界知识库、文字渲染效果优化以及角色与物体一致性表现提升。

在Nano Banana 2.1中,谷歌围绕原有能力继续升级。视觉设计方面,新版可生成构图效果更佳、完成度更高的视觉素材;蒙版编辑方面,用户可更精准选中并修改现有图像局部区域,无需重新生成整张画面;主体一致性方面,模型在执行编辑操作或批量生成多张关联图片时,可更好保留画面主体样貌与特征。

IT之家提到,改进后的主体一致性对Gemini用户具有较强实用性,可保证同一个人物或物体在多次生成结果中保持样貌统一。

目前,Nano Banana 2.1已逐步部署上线,覆盖Gemini应用、谷歌搜索的AI模式、Google AI Studio、Google Flow、Stitch、谷歌广告以及Gemini企业平台。面向开发者,该模型已正式开放,模型ID为gemini-nano-banana-2.1;它支持文本、图片、音频和视频输入,并可输出1K、2K和4K分辨率图像。

IT之家还提到,OpenAI的ChatGPT Images 2.5仍被其列为全球领先的图像生成编辑模型;在用户持续微调一张图片时,它更擅长保留上一轮修改成果,不会改动未编辑区域,也不会因反复迭代导致原图画质下降。紧随其后的是微软AI的MAI-Image-2.6模型,该模型于今年8月发布。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com。
来源:驱动中国 · 原文链接:https://www.qudong.com/article/525372.html
本文价值 ★★★★★ — 成为第一个评分的人
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
✎ 我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友