gpOpenAI 正式发布新一代图像生成与编辑模型 ChatGPT Images 2.5。这是今年 4 月 ChatGPT Images 2 推出约五个月之后的一次重要升级。

相比 Images 2,此次 2.5 版本并没有单纯追求更高的输出分辨率,而是把升级重点放在了画面细节、生成速度、参考图一致性和图片编辑准确度几个直接影响实际使用体验的方向。

图片细节、光影和材质进一步提升

ChatGPT Images 2 已经支持最高 2K 图像输出、多种宽高比,并强化了非拉丁文字处理能力,同时提供 Instant 和 Thinking 两种不同的智能等级。

到了 Images 2.5,OpenAI 进一步提升了最终画面的视觉质量。

新模型能够生成更加自然的光线效果和更加丰富的材质纹理,尤其是在人物、产品、建筑以及复杂场景中,细节表现会更加锐利。

这意味着 Images 2.5 的提升并不只是简单的“更清晰”,而是在模型对光照、材质以及画面结构的理解上进一步加强。

对于产品摄影、广告素材、电商主图以及写实人物摄影等应用场景,这类升级会比较明显。

参考图片的人物和主体更容易保持一致

Images 2.5 的另一个重要改进,是参考图片主体保持能力

使用一张人物照片或者产品照片作为参考,然后要求 AI 更换背景、服装、环境或者摄影风格时,AI 生图经常会出现人物面部变化、产品结构变化等问题。

Images 2.5 针对这一问题进行了优化。

模型能够更好地保留参考照片中的主体特征,在进行图片重新创作或者局部修改时,尽可能避免把原始主体“重新设计”一遍。

对于需要连续生成同一个人物、同一款产品或者同一个 IP 角色的应用来说,这项能力非常重要。

多轮图片编辑更加可靠

相比一次生成完成,OpenAI 越来越强调通过对话不断修改图片。

例如:

“把背景换成办公室。”

接着要求:

“保持人物不变,把衣服换成黑色西装。”

然后继续:

“人物和衣服都不要修改,只把画面改成夜景。”

Images 2.5 针对这种连续多轮编辑进行了优化。

模型能够更加准确地理解哪些元素需要修改、哪些元素应该保持不变,从而降低修改一个区域却意外改变其他内容的问题。

对于 AI 图片工作流而言,这实际上比单纯提升第一次生成质量更加实用,因为用户可以像修改设计稿一样,通过多轮指令逐渐完成最终图片。

图片生成延迟最高降低 50%

除了画质之外,Images 2.5 还重点改善了生成速度。

OpenAI 表示,与 Images 2.0 相比,新版本的图片生成延迟最高可以降低 50%

对于普通 ChatGPT 用户来说,这意味着等待图片生成的时间进一步缩短。

而对于通过 API 批量生成图片的应用来说,速度提升的价值更加明显。例如电商素材、社交媒体图片、产品展示图以及大规模 AI 图片生成平台,都能够获得更高的生成效率。

ChatGPT 新增 Sketch 草图功能

伴随 Images 2.5,ChatGPT 还加入了一项新的 Sketch 功能。

用户可以直接在 ChatGPT 中绘制简单草图,然后将草图作为图片生成的参考。

例如可以简单画出:

人物应该站在哪里、产品应该放在哪里、背景物体如何排列,以及整体构图的大致位置。

随后让 Images 2.5 根据草图生成完整图片。

这实际上给自然语言 Prompt 增加了一种更加直观的“空间提示方式”。对于很难用文字描述的构图,直接画出来通常比写几十行 Prompt 更有效。

此外,OpenAI 还增加了常用图片格式模板以及 Prompt 分享功能,用户可以把自己的图片生成方案分享给其他人直接尝试。

API 推出 Flare 和 Sunburst 两个版本

Images 2.5 同时进入 OpenAI API,并针对不同应用场景提供两个模型版本:

GPT-Image-2.5 Flare

这是面向大多数应用的默认选择。

它继承 Images 2.5 在画质、编辑和生成速度方面的升级,相比 GPT-Image-2 可以提供更高质量的图片,同时延迟降低约 50%。

比较适合社交媒体内容、创作者工具、产品功能、视觉搜索、快速原型以及大规模图片生成。

GPT-Image-2.5 Sunburst

Sunburst 更偏向高质量专业视觉工作流。

它更加注重连续编辑过程中的控制能力,适用于广告创意、品牌视觉、电商产品图片以及需要反复修改的专业图片制作场景。

简单理解,Flare 更强调质量、速度和规模之间的平衡,而 Sunburst 更强调专业图片制作中的精细控制。

ChatGPT、Work 和 Codex 同步上线

ChatGPT Images 2.5 已开始向不同平台和用户层级推送,覆盖桌面端、移动端以及 Web 端,并应用于 ChatGPT、ChatGPT Work 和 Codex。

从这次升级方向来看,OpenAI 对 AI 图片能力的重点正在从“根据一句 Prompt 生成一张漂亮图片”,进一步转向可编辑、可连续修改、能够保持主体一致性的完整视觉创作工作流

特别是参考图一致性、多轮精准编辑、Sketch 草图以及两款不同定位的 API 模型,让 Images 2.5 更适合真正嵌入电商、广告设计、产品视觉和内容生产系统。