GPT Image 2.5:OpenAI 最新图像模型有哪些新功能
了解 GPT Image 2.5 更出色的参考图一致性、更精准的编辑、更好的多轮一致性、创意控制功能以及更快的图像生成速度。
GPT Image 2.5 专注于一个比生成单张令人惊艳的图像更重要的问题:在持续创作时,保留正确的细节。OpenAI 的新图像模型结合了更清晰的渲染、更快的生成速度、更可控的编辑,以及跨多次修改时更好的一致性。
OpenAI 于 2026 年 9 月 8 日推出了 ChatGPT Images 2.5。该模型正陆续上线 ChatGPT、ChatGPT Work 和 Codex,开发者则可使用两个 API 版本:GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst。
GPT Image 2.5 最重要的升级
此次发布不只是让图像看起来更精致。它最实用的改进影响了完整的创意工作流——从使用参考图,到在无需重建素材的情况下进行针对性修改。
更高的参考图保真度
当使用参考照片创建新场景、风格或构图时,主体需要保持可辨识性。OpenAI 表示,GPT Image 2.5 能更好地保留参考图像中的鲜明特征,同时生成更自然的光照和更丰富的纹理。
这使此次更新尤其适用于涉及人物、产品、地点、重复出现的角色以及其他必须在视觉上与原始图像保持关联的素材工作流。
| 输入 | 编辑结果 |
|---|---|
![]() | ![]() |
发布页面还通过一只宠物展示了同样以参考图为主导的理念:这只狗依然清晰可辨,而它的服装则变成了一套细节丰富的特技服装。
| 输入 | 编辑结果 |
|---|---|
![]() | ![]() |
更精准的图像编辑
当所请求的更改同时改变了主体、构图、背景或品牌呈现时,图像编辑往往会失败。GPT Image 2.5 旨在修改所请求的元素,同时让无关细节保持更稳定。
OpenAI 强调了诸如更改产品、背景或文案等实用编辑,无需重建整个视觉画面。这对于产品图、营销素材、版式修改以及其他需要让小改动保持为小改动的工作非常有用。
上方的输入肖像与编辑后肖像展示了发布页面中以参考图为主导的工作流:按要求更改服装,同时保持姿势和蓝色影棚背景在视觉上的关联性。
全身图序列对比了 GPT Image 2 和 GPT Image 2.5 中连续进行的编辑,相比单一最终画面,更便于检视多次更改中的差异。
此次发布还通过一个简单的房间编辑,展示如何在改变一个指定状态的同时,让更广阔的场景依然保持可辨识性。
| 输入 | 编辑结果 |
|---|---|
![]() | ![]() |
跨多次编辑的一致性更强
当一张图像需要经过多轮优化时,一次成功的编辑并不足够。在较长的对话过程中,GPT Image 2.5 旨在随着新指令的加入,更可靠地保留先前的修改。
这减少了一种常见的创意偏移:修正一个细节后,却发现此前的改进消失了。因此,此次更新适用于迭代式制作工作流,而不只是一次性生成。
立方体旋转序列测试了物体在完整旋转过程中能否保持结构连贯。与仅重新设计一个静态画面相比,这是一个对一致性要求更高的示例。
旅行信息图序列展示了另一项挑战:随着编辑不断累积,照片、行程细节和文字必须持续作为一个整体版式发挥作用。
更强大的版式、风格与透明图像能力
GPT Image 2.5 还改进了对复杂视觉指令的处理。OpenAI 特别提到,它对现实世界信息、更复杂的版式、透明背景,以及对指定视觉风格的遵循都有更好的支持。
这些能力可帮助创建如下素材:
- 产品抠图和透明背景图形;
- 共享统一视觉方向的营销活动变体;
- 具有明确层级的 UI 概念;
- 演示图形和结构化构图;
- 在一份需求说明中结合多项视觉要求的图像。
这些是官方宣称的能力,并非独立基准测试结果。输出质量仍可能因输入、提示词、设置和任务复杂度而异。
更快的图像生成
OpenAI 表示,与 Images 2.0 相比,图像生成延迟最多降低了 50%。该公司将 GPT-Image-2.5 Flare 定位为更快的默认 API 选项,适合日常创作和较高产量的工作流。
Sunburst 则满足另一种需求:为细致的创意和编辑工作提供更精准的控制,但生成时间更长。这两个版本并不只是“好”和“更好”的区别——它们优先满足不同的制作需求。
ChatGPT 中的新创意控制功能
Images 2.5 的发布还为 ChatGPT 带来了围绕该模型的多项产品功能:
- **草图:**直接在 ChatGPT 中绘制粗略的视觉参考;
- **模板:**从海报、周边商品或产品照片等格式开始;
- **图像评论:**在图像的特定部分添加反馈;
- **提示词分享:**让其他人使用自己的细节复用某个图像创意。
这些功能属于 ChatGPT 体验的一部分,不应假定每种基于 API 的实现都具备这些功能。
GPT Image 2.5 适合谁?
根据其已记录的能力,GPT Image 2.5 最适合需要持续优化图像,而不是生成一次便停止的创作者和团队。其最明确的潜在价值体现在参考图驱动的创作、针对性编辑、反复修改的营销活动、产品图、视觉原型设计和结构化创意素材中。
本文总结了 OpenAI 在其 GPT Image 2.5 公告中描述的能力。本文并非独立的实际上手评测。
更实用的图像模型升级
GPT Image 2.5 最有意思的承诺并不是一张吸睛的图像,而是一个更可靠的编辑循环:从参考图开始,修改一个细节,保留已有的有效部分,并持续优化而不产生不必要的偏移。
Flare 和 Sunburst 以不同的优先级将这一工作流带到 API 中。如果您需要判断哪一个更适合自己的制作流程,请继续阅读我们的 GPT Image 2.5 Flare 与 Sunburst 对比。













