Gemini 2.5 Flash 升级,AI图像编辑新高度

谷歌最新推出的 Gemini 2.5 Flash 图像编辑模型,凭借高准确率和角色一致性功能,在图像编辑领域表现出色,尤其在文字指令修改和风格迁移方面超越 GPT-4o。

9效率工具图像编辑AI工具效率提升Gemini 2.5 Flash

背景介绍

谷歌 DeepMind 近期推出了全新的 Gemini 2.5 Flash 图像编辑模型,该模型在 Gemini 应用中可根据文字指令进行精确的图像修改,尤其在保持人物和动物外观一致性的同时,提高了编辑精度。

谷歌 Gemini 2.5 Flash 升级 AI 修图功能,多项表现优于 GPT-4o插图

功能亮点

  • 角色一致性:在生成多张图像后,即使人物姿势、背景或光线发生变化,也能保持同一人、动物或物体的外观一致。
  • 局部文字编辑:无需手动圈选即可完成背景虚化、去除瑕疵、添加颜色或移除物体等操作。
  • 风格迁移:将一种纹理、颜色或图案应用到另一物体上,同时保持形状与细节完整。
  • 现实推理:模拟简单因果,如生成气球飞向仙人掌及随后的结果画面。

使用方法

用户需将模型切换至“Flash”才能使用图像编辑功能,生成的图像附有可见水印及不可见的 SynthID 数字水印。

谷歌 Gemini 2.5 Flash 升级 AI 修图功能,多项表现优于 GPT-4o插图1

获取途径

开发者可通过 Gemini API、Google AI Studio 与 Vertex AI 试用,费用为每百万输出 token 30 美元,单张图像成本约 0.039 美元。