Gemini 2.5 Flash Image(代号“Nano Banana”)是谷歌DeepMind于2025年8月推出的AI图像生成与编辑模型,通过Gemini API、Google AI Studio、Vertex AI提供预览服务,2025年10月正式进入生产环境阶段并开放商业授权,新增支持批量处理和10种长宽比效果。该模型在图像质量、编辑控制和多场景应用方面实现突破,支持角色外观一致性保持、自然语言及语音指令驱动的局部编辑,以及多图像融合处理功能,集成世界知识增强语义理解并设置安全机制限制特定内容生成。
2025年9月,谷歌实验室副总裁Josh Woodward透露模型上线首月累计完成超2亿次图像编辑,新增用户超1000万,导致TPU严重过载。在LMArena大模型竞技场图像编辑榜单中以1362分位列全球第一,文生图榜单排名第三,后被腾讯混元图像3.0超越。该模型定价为每100万个输出Token 30美元,单张图像成本约0.039美元,上线预览阶段在Gemini AI平台创作超50亿个作品,现已集成至Adobe Firefly等第三方平台,用户可通过该平台制作风格一致的图形系列并生成适配社交媒体、传单等多种格式的视觉内容。
2025年10月14日,谷歌宣布该模型扩展至Google搜索和NotebookLM应用,支持通过Lens创作模式生成新图像版本,并在NotebookLM中集成视频概览功能;谷歌同时宣布该模型即将登陆Google Photos。2026年9月5日,Gemini Spark功能正式支持管理Google Photos照片库。Gemini应用月活跃用户达到6.5亿。
当地时间2025年8月26日消息,谷歌DeepMind发布新一代AI图像生成与编辑模型Gemini 2.5 Flash Image(代号“Nano Banana”)。
2025年9月,谷歌实验室副总裁Josh Woodward在X上透露,自该功能上线以来,累计已完成超2亿次图像编辑,带动超1000万新用户尝试Gemini应用。对于这款产品的受欢迎程度,他形容称内部“TPU严重过载,SRE警报不停。”
2025年10月消息,Gemini 2.5 Flash Image正式进入生产环境阶段,开始提供商业授权,官方同步更新模型新增支持创建10种长宽比效果,并新增图片批量处理功能。
2025年10月14日,谷歌宣布,其最新的图像编辑模型Nano Banana(Gemini 2.5 Flash Image)将陆续登陆Google搜索、NotebookLM,并即将扩展至Google相册。
Gemini 2.5 Flash Image相较2025年早些时候发布的Gemini 2.0 Flash Image,在图像质量、编辑控制和应用场景上有大幅改进。用户不仅可以对人物和宠物进行精准编辑,保持其特征一致,还能实现多图合成、多轮次修改与风格迁移等复杂操作。
图像生成领域的一个核心挑战是在多次提示和编辑中保持角色或物体的外观一致性。Gemini 2.5 Flash Image通过先进技术完美应对这一难题,支持将同一角色置于不同场景、展示产品在多角度与多环境下的效果,或生成统一的品牌资产,同时确保主体外观高度一致。
Gemini 2.5 Flash Image支持通过自然语言进行精准的局部编辑与目标性转换。用户仅需输入简单文本提示,即可实现背景模糊、去除衣物污渍、删除照片中的人物、调整主体姿势,或为黑白照片添加色彩等多样化操作,极大地释放了创意潜能。
相较于传统图像生成模型在美观图像生成上的优势,Gemini 2.5 Flash Image通过整合Gemini的世界知识,突破了语义理解的局限,开辟了全新应用场景。
Gemini 2.5 Flash Image能够理解并融合多张输入图像。用户可通过单一提示将物体置入新场景、为房间重新设计配色或纹理,或生成逼真的多图融合图像,满足多样化的创作需求。
尽管Gemini 2.5 Flash Image降低了用户创作和编辑真实感图像的门槛,但谷歌也设置了安全防护机制,限制用户生成特定内容。事实上,谷歌过去在AI图像生成器的安全防护方面曾遭遇挑战:此前,Gemini因生成与历史事实不符的人物图像引发争议,谷歌不仅为此致歉,还一度下架了该AI图像生成功能。