【OpenAI 昨天正式更新了 ChatGPT Images 2.5。】

简单体验和看完官方介绍后,我觉得这次升级最值得关注的,并不是单纯"生成出来的图片更漂亮了"。

而是:

AI 生图正在从「一次性生成图片」,变成真正的「可迭代视觉创作工具」。

1. 参考图终于更容易"保住原来的东西"

以前用 AI 改图经常遇到一个问题:

我只让你换个背景,怎么连人物的脸、衣服、构图都一起换了?

Images 2.5 重点加强了 reference fidelity。

简单来说就是:

该改的改,不该改的尽量别动。

人物特征、主体、光照、纹理、构图等信息,在连续修改过程中会更加稳定。

这对于:

  • 人像修图

  • 产品图

  • UI 效果图

  • PPT 配图

  • 汽车场景图

  • 品牌视觉素材

其实比单纯提升"画质"更重要。


2. 多轮改图能力明显变得更重要了

AI 生图真正难的,从来不是:

「给我生成一张图。」

而是:

第一次生成以后继续说:

  • 车不要动,只改背景

  • 人物保持完全一致

  • 把左边组件删掉

  • 中间留白扩大

  • Logo 往上移动

  • 保持整体风格,再生成一版夜景

以前改到第三四轮,图片很容易逐渐"漂掉"。

Images 2.5 专门强化了 Multi-turn Editing Consistency

也就是说,ChatGPT 开始更像一个可以反复沟通的设计师,而不是一个只能抽卡的图片生成器。


3. 生成速度继续提升

官方给出的数据是:

相比 ChatGPT Images 2.0,生成延迟最高降低约 50%。

对于生图来说,这个升级其实很关键。

因为真正做设计的时候,很少有人只生成一次。

通常是:

生成 → 看效果 → 修改 → 再生成 → 微调 → 再修改

速度越快,AI 生图才越接近真正的设计工作流。


4. 新增 Sketch:不会写 Prompt?直接画

这个功能我觉得很有意思。

现在可以使用 @Sketch,先随手画一个草图,然后让 ChatGPT 根据草图生成正式图片。

比如你可以非常粗糙地画:

「左边一辆车,中间一个安全引擎,右边三个风险模块。」

甚至只是几个框和箭头。

然后告诉 ChatGPT:

把这个草图做成一张专业的汽车 AI 安全架构图,科技感、适合 PPT 汇报。

未来很多时候,我们可能根本不需要花很长时间描述"左上角是什么、右边是什么"。

直接画给 AI 看。


5. Templates:Prompt 也开始模板化

Images 2.5 还加入了模板能力。

例如:

Poster、Merch 等常见视觉格式,可以直接选择模板,再填写:

  • 想表达的信息

  • 文案

  • 风格

  • 设计元素

  • 图片素材

本质上,它正在降低专业 Prompt 的门槛。

以后生成海报、商品图、宣传素材,不一定需要自己从零写几十行提示词。


6. 可以直接在图片上"评论修改"

另一个很实用的方向是:

Comment-based Editing。

以前修改图片需要用文字描述:

把右上角那个红色区域删掉。

现在越来越接近设计软件的逻辑:

直接指出图片上的区域,然后告诉 AI 这里怎么改。

这个交互变化其实非常重要。

因为视觉设计天然就是空间语言。

很多东西"指一下"比写 100 个字描述更准确。


7. Prompt 现在也可以跟着图片一起分享

Images 2.5 还加入了 Prompt 分享。

看到别人生成了一张很不错的图片,不再只能问:

Prompt 能发一下吗?

分享图片时,可以把 Prompt 一并分享出去。

别人可以直接基于你的 Prompt:

换自己的照片、素材和内容,继续生成自己的版本。

这可能会进一步催生一种新的东西:

AI 图片模板 / Prompt 模板。


8. API 也同步升级

这次开发者侧同时推出两个模型:

GPT-Image-2.5 Flare

偏速度、质量与成本平衡,适合大多数图片生成场景。

以及:

GPT-Image-2.5 Sunburst

更偏向高精度创作和复杂编辑,适合广告、产品视觉、专业设计等对细节控制要求更高的任务。


我觉得这次更新真正值得关注的是:

过去 AI 生图的核心逻辑是:

Prompt → Image

现在逐渐变成:

想法

草图 / 参考图 / Prompt / 模板

生成

局部评论修改

连续迭代

保持主体一致

最终成品

这已经越来越不像一个「AI 绘画工具」。

而更像一个:

AI Visual Agent。

未来设计师可能不会消失。

但「会不会画」和「会不会写 Prompt」的重要性,可能都会慢慢下降。

真正重要的能力会变成:

你能不能清楚地告诉 AI,你到底想要什么。

这可能才是 Images 2.5 最值得关注的地方。

#ChatGPT #OpenAI #AI生图 #Images25 #AIGC #人工智能 #AI工具 #生成式AI

相关推荐
feiyu_gao3 小时前
Cocreation Framework:一套给所有人的 AI 协作思考系统
设计模式·aigc·ai编程
_张一凡3 小时前
【AIGC面试面经第12期】具身智能算法工程师面试面经相关问题汇总
aigc·具身智能·面试面经
码农学院3 小时前
外贸独立站GEO实战:用 Python 自动生成多语言 llms.txt 和 Schema 站点地图
人工智能·python·chatgpt·geo·geo优化·ai优化aio
周末程序猿3 小时前
技术总结|十分钟了解 Palantir 数据本体论
aigc
一航jason3 小时前
大模型“上车“评估参数列表
人工智能·ai·aigc·ai编程·ai-native
Dawson Zhu4 小时前
从“会回答“到“能执行“:AI Agent 的系统构成、运行机制与工程实践
人工智能·语言模型·架构·aigc·agi
粉色大象5 小时前
handdrawn‑architecture‑video:开源SVG架构图转手绘4K动画视频|本地AI Agent Skill
人工智能·ai·ai作画·系统架构·开源·aigc·音视频
VIP_CQCRE5 小时前
用 Ace Data Cloud 快速接入 Kling 视频生成 API:把 AI 视频能力接进你的产品
aigc·api·ai视频·kling·acedatacloud
leeyi6 小时前
Token 账单减下来:从路由到裁剪的五道闸门(第109篇)
aigc·agent·设计