OpenAI新图像模型:以前改图动一处全身,现在圈哪儿改哪儿
OpenAI 发布新一代图像模型 ChatGPT Images 2.5,今天起向所有 ChatGPT、ChatGPT Work 和 Codex 用户推送,桌面端、移动端和网页都能用。这次发布里给出的规模数字是:每周有超过 30 亿张图片经由 ChatGPT Images 和 API 里的 GPT-Image 模型生成。新模型细节更清晰、编辑更精确、生成更快,延迟比上一代 Images 2.0 最多降 50%。
以前在 AI 图像工具里改图,最怕改一处动全身。你想只动某个细节,AI 却把其他地方也换了。Images 2.5 改的正是这个:你要求改哪里,它就只改哪里,其余细节保持不变,主体和背景再复杂也一样。配合更快的生成速度,整个流程变成:改,看,再改,再看。
操作方式也变了。ChatGPT 新增 Sketch 功能,输入框里打 @Sketch 就能调出。直接画一张草图当参考,AI 照着它出成品图,随手勾几笔就行。另一种方式更直接:把批注直接放在图片上,圈出要改的位置。这跟在文档里做批注差不多,只不过对象是一张图。两件事合在一起,修图的核心动作变成了“指出位置”。
多轮修改是这次更新的一个重点。在较长的对话里连续改一张图,Images 2.5 能跨多轮保持之前的修改结果。每一轮编辑都基于上一轮继续,图像质量不会因为改的次数多而下降。模型读懂图像内容的能力也更强:涉及真实世界信息的图,内容更准确;更复杂的排版能处理,包括透明背景,logo、贴纸这类东西有了空间。传参考照片时的表现也不一样。把熟悉的人或物体放进新场景、新视觉风格里,可识别性更高,光照和纹理更自然,特征也保留得更好。艺术风格上的还原,也更贴近你原本的构思。
这轮更新对不做设计的人也有上手工具。模板功能覆盖海报、产品照片这类常用格式,里面直接选 'Poster'、'Merch' 这样的格式。选好模板,填上要传达的信息,加点设计元素或风格,就能得到一张能用的宣传物料,不用从空白画布开始。分享功能把提示词也带上了。分享图片时可以选择附带生成它的提示词,别人拿到同一段提示词,用自己的照片和细节,做出自己的版本。
API 同步推出两个新模型。GPT-Image-2.5 Flare 是默认选择,质量高于 GPT-Image-2,延迟低 50%,适合大多数应用场景。GPT-Image-2.5 Sunburst 面向精细工作流,比如制作级广告创意或精致的商品图,生成时间更长,编辑控制更紧。Sunburst 比 Flare 具体慢多少、定价如何,OpenAI 没有说。图像出处标识沿用此前机制:生成图带 C2PA 元数据和不可见水印,用来辨认哪些图来自 OpenAI 的工具。新模型沿用此前的安全措施,评估细节没有展开。
从每周 30 亿张的生成量看,图片生成已经不是新鲜事。这轮更新的重点,从生成一张图移到了改一张图上,而且改的每一步都算数。