
Gemini 2.5 Flash 升级,AI图像编辑新高度
谷歌最新推出的 Gemini 2.5 Flash 图像编辑模型,凭借高准确率和角色一致性功能,在图像编辑领域表现出色,尤其在文字指令修改和风格迁移方面超越 GPT-4o。
背景介绍
谷歌 DeepMind 近期推出了全新的 Gemini 2.5 Flash 图像编辑模型,该模型在 Gemini 应用中可根据文字指令进行精确的图像修改,尤其在保持人物和动物外观一致性的同时,提高了编辑精度。

功能亮点
- 角色一致性:在生成多张图像后,即使人物姿势、背景或光线发生变化,也能保持同一人、动物或物体的外观一致。
- 局部文字编辑:无需手动圈选即可完成背景虚化、去除瑕疵、添加颜色或移除物体等操作。
- 风格迁移:将一种纹理、颜色或图案应用到另一物体上,同时保持形状与细节完整。
- 现实推理:模拟简单因果,如生成气球飞向仙人掌及随后的结果画面。
使用方法
用户需将模型切换至“Flash”才能使用图像编辑功能,生成的图像附有可见水印及不可见的 SynthID 数字水印。

获取途径
开发者可通过 Gemini API、Google AI Studio 与 Vertex AI 试用,费用为每百万输出 token 30 美元,单张图像成本约 0.039 美元。