如意小报
版块首页原文 ↗
AI · 新闻详情

AGI时代的第一个生图模型,ChatGPT Images 2.5上线

大模型 · 量子位 · 量子位 · 2026-09-10 · 重磅值 86.71
真正值得关注的不是量子位这一条动作本身,而是它可能把「大模型」的竞争焦点推向能力、成本与开放生态的再平衡。
发生了什么:主打生成更快,细节更好,改图也终于越来越像“真·修图”了。
为什么重要:模型能力的变化,可能重塑下一批产品的技术底座。
观察窗口:后续要看开放范围、价格策略、真实评测以及开发者是否愿意迁移。
正文来源:原文正文机器翻译
原文链接:https://www.qbitai.com/2026/09/486684.html

在喊出“AGI时代来了”之后,你奥特曼叔叔搬出来的第一个东西,就是多模态!

刚刚,OpenAI发布新一代生图模型, ChatGPT Images 2.5 ,主打生成更快,细节更好,改图也终于越来越像“真·修图”了。

只要用鼠标(或者随便什么)画一张草图,再补充你想要的风格和细节,GPT就会把它作为视觉参考,生成完整图片。

一如既往,对于懒人,OpenAI也准备了一套新的模板,直接套就完事了。

By the way,现在GPT终于支持看百分比的生成进度了,不用再问“在吗”看网断没断了!

如果说上面这些是功能层面的变化,那么从这次技术博客来看,相比4个半月前发布的GPT Image 2,Images 2.5真正值得看的升级,还是 生成质量和编辑稳定性本身 。

Images 2.5并没有单纯继续往上堆输出分辨率,最高依然是3840px,但新增了 xhigh和max质量档位 ,进一步提升细节、材质纹理、光照,以及参考主体的保真度。

给小孩哥换了一身衣服之后,脸部基本没怎么漂,尤其是原图里卷发那种稍微有点毛躁的质感,保留得相当完整。

但像下面这种,把原始照片重新还原、放大,同时重新处理打光,效果还是挺惊艳的。

而相比单纯“把图画得更漂亮”,Images 2.5这次更重要的一个方向就是让修图改图变得更加可控。

虽然有些图看起来还是稍微有点“AI塑料感”,但人物本身、场景关系和整体构图已经能比较稳定地保留下来。

不用再写一大段“请把画面左上角第二个人脸上的墨镜换成黑框眼镜”,直接圈那个地方,写一句要求就行。

比如我在表情包生成界面里,直接在墨镜的位置批注“换成黑框眼镜”,点发送。

版式已经定了,需要替换的只是城市信息,但每做一版,你都希望继续沿用前面的设计。

很多时候,对于设计工作者来说,一张图不可能一遍生成就结束。第一轮把主体生成出来,第二轮改排版,第三轮换文字,第四轮再抠一些细节。

以前经常改着改着就变成:这次这里终于对了,结果刚才已经对的地方又坏了。

OpenAI表示,在更长的对话中,Images 2.5可以更稳定地接着上一轮结果继续修改,同时保住已经确认好的内容和画质。

比如下面这种旅行攻略海报,文字、照片、路线、排版全挤在一张图里,修改时需要同时照顾的元素比单主体图片多得多。

当然,除了编辑之外,Images 2.5对复杂画面、材质和风格指令的理解也一起升级了。

当然了,生图这玩意,本质上还是创造力工具。就像奥特曼说的,它又不是拿来做数学题的。

输入就一张马喽的照片,让它给我生成一组“马喽在世界各地旅游打卡”的照片。

所以到底是史诗级升级,还是熟悉的“这边补好了,那边又冒出新Bug”,大家实测下来也可以说说。

听着没有“画质炸裂”那么性感,但真到了反复改图的时候,少等一半其实相当重要。

既然要你第一轮改内容、第二轮改版式、第三轮继续抠细节,那生成速度自然也得跟上。

它更强调质量、编辑能力和速度之间的平衡,也是官方推荐的大多数应用默认使用的版本,适合社交内容、快速视觉原型和大批量生图等场景。

它瞄准的是更精细的创作和编辑需求,比如正式投放的广告素材、产品图片,以及对画质要求更高的视觉内容。

所以整体看下来,Images 2.5这次跟2那种直接生成老照片质感的视觉冲击还差点意思?

但它确实把生成模型开始真正进入生产流程之后,那些不多轮交互、定点修改的问题进一步清扫了一遍。

换句话说,过去大家用生图模型,多少还有点“抽卡”,现在直接定点p就完事了。

机器翻译/自动整理可能存在误差,请以原文为准。

继续阅读

正在加载推荐…