OpenAI 发布 ChatGPT Images 2.5,把图像生成的竞争重点从“能不能生成”进一步推向“能不能连续修改”。新模型强化细节、参考图主体保真和多轮编辑一致性,生成延迟较 Images 2.0 最多降低 50%;OpenAI 称,ChatGPT Images 与 API 图像模型每周已生成超过 30 亿张图片。
从文字提示走向直接操作
Images 2.5 新增 Sketch、模板和图片评论功能。用户可以直接在 ChatGPT 中画草图作为参考,也能针对图片局部留下修改意见,不再完全依赖长提示词描述。
模型本身也更强调“少改错”:修改单个元素时,尽量保留人物、构图、背景和此前编辑结果。对电商图、广告素材、社交内容这类需要反复迭代的场景,这比单次出图质量更关键。
API 分成速度与精度两条线
面向开发者,OpenAI 同步推出 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst。Flare 主打高质量与低延迟,官方将其定位为大多数应用的默认选择;Sunburst 则面向更强调编辑精度和成片质量的专业工作流。
两款 API 模型都支持文本与图像输入。OpenAI 当前列出的图像输出价格均为每百万 token 30 美元,图像输入为每百万 token 8 美元。
AI 图像开始争夺工作流
Images 2.5 已向 ChatGPT、ChatGPT Work 和 Codex 各档用户开放,覆盖桌面端、移动端和 Web。安全层面继续使用 C2PA 来源信息,并加入 SynthID 隐形水印。
这次升级的核心并不是再做一个“更会画画”的模型,而是把草图、参考图、局部批注和多轮修改串进同一套 AI 创作流程。图像模型下一阶段的竞争,很可能取决于谁能更接近真正可控、可复用的生产工具。