OpenAI 近期推出 ChatGPT Images 2.5,把图像生成延迟最多压低一半,并在主对话流里加入 Sketch 草图参考、模板库与图片内评论标注三件套。用户可以先画一张潦草草图作为构图参考,再让模型按草图生成;也能基于既有图片做局部圈注修改,而不必整张重画。
一、这次升级点什么
Images 2.5 的核心变化不是「画得更漂亮」,而是「改得更顺手」。过去文生图工具的价值曲线集中在第一次生成,后续修改往往要换提示词重来;新版本明确把产品方向拉向可反复控制和精修的创作工具。草图参考降低了人与模型之间的沟通成本,图片内评论标注则让「圈哪里、改哪里」变成显式指令,而不是靠文字反复描述。
二、从「生成一张图」到「反复精修」
这一转变与 GPT-6 Astra 的多模态能力形成协同:生图不再是独立功能,而是主对话流的一环。决定用户体验的关键变量,也从单次生成质量,转向人物与物体的一致性、局部编辑准确率、版权治理与高峰期稳定性。对设计师和内容团队而言,Sketch 式草图参考让「脑内构图」更快落地;但也意味着工具要经得起多轮迭代的考验。
三、客观边界:价值取决于细节
新能力的实际价值仍取决于几项硬指标——局部编辑准确率能否达到可商用水平、人物一致性是否经得起连续修改、高峰期稳定性与生成成本是否可控。OpenAI 尚未披露具体基准与独立复现数据,相关结论以厂商自述为主。对大多数团队,更理性的预期是把它当作「带记忆的精修画布」,而非一次性出图的魔法棒。