OpenAI 发布 ChatGPT Images 2.5:生图延迟最多降 50%,加入 Sketch 草图与局部批注编辑
据 IT之家 9 月 9 日消息,OpenAI 于当天官宣推出 ChatGPT Images 2.5,定位为其当前最先进的图像生成模型。相比此前发布的 Images 2,新版本的核心升级集中在生成速度、图像质感和可控编辑能力上:在细节锐度、自然光照和纹理丰富度提升的同时,图像生成延迟最多降低 50%。同时,OpenAI 还为 ChatGPT 图像创作流程加入 Sketch 草图参考、模板库、图片内评论标注等功能,试图让 AI 生图从“输入提示词等结果”进一步走向可迭代、可精修的创作工作流。
从文字生图到草图驱动:ChatGPT Images 2.5 强化创作可控性
此次更新中,最值得关注的新功能是 Sketch 草图参考。来源显示,用户可在对话中通过输入“@Sketch”调用该功能,直接绘制草图,并补充风格、构图、细节等描述,随后由模型将草图转化为完整图像。这意味着用户不必完全依赖长提示词来描述空间关系和画面结构,而是可以用更直观的方式表达构图意图。
对设计师、内容创作者和产品团队而言,草图输入能够降低沟通成本。例如海报布局、产品概念图、社交媒体配图等场景,往往需要先确定主体位置、视觉层级和大致风格,再不断微调。Sketch 的加入,能够把“先画大概,再让模型补全”的流程整合进 ChatGPT 对话中。
同时,ChatGPT Images 2.5 还新增了海报、商品等常见创作格式模板。模板库的意义在于进一步降低使用门槛,让不熟悉提示词工程的用户也能快速进入标准化创作流程。
- 生成速度:在质量提升的同时,延迟最多降低 50%。
- 草图参考:支持通过“@Sketch”在对话中绘制草图并生成完整图像。
- 模板创作:新增海报、商品等常见格式模板。
- 局部编辑:可在图片内标注修改区域,并下达删除、改色等指令。
- 分享协作:分享图像时可附带原始提示词,便于复现和交流。
图片内评论标注:AI 修图更接近协作式工作流
除了生成能力,Images 2.5 对编辑流程的改进同样关键。来源显示,用户可以直接在图像上添加批注,聚焦具体修改区域。例如在图片中圈定某处后发出“删除此区域”或“将此改为蓝色”等指令,模型将仅修改指定区域,其余部分尽量保持不变。
这类功能的价值在于提升多轮编辑的稳定性。过去 AI 生图在二次修改时常见的问题是:用户只想改一个局部,但模型可能重绘整张图,导致人物、产品形态、背景细节发生偏移。OpenAI 表示,新模型在多轮编辑过程中能更好保持图像一致性和质量,减少反复修改后的细节退化。
对于商业设计和产品视觉团队来说,这一变化可能比单纯“更会画”更实用。因为成品级素材往往不是一次生成完成,而是需要在构图、字体占位、颜色、光影、商品边缘等细节上持续打磨。图片内评论标注让 AI 生图更像设计协作工具,而不是一次性出图工具。
API 分为 Flare 与 Sunburst:覆盖快速生成和高控制编辑
在 API 调用方面,OpenAI 提供了两款模型:GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunburst。来源显示,Flare 面向多数图像生成应用,适合创作者内容、社交内容、产品体验、视觉搜索、快速原型和高批量生成等场景;Sunburst 则面向对编辑控制要求更高的工作流,OpenAI 建议用于成品级营销素材和精修产品图等任务,但其生成时间更长。
分层模型策略反映出图像生成市场正在从“单一模型通吃”转向“按工作流选择模型”。快速原型和社交内容更看重速度与成本,而营销物料、产品图和品牌视觉则更重视精确控制、一致性和可修订性。
API 还支持多种分辨率,包括 1024×1024、2048×2048、3840×2160(4K 横向)等,单边最长不超过 3840 像素,总像素数介于 655,360 至 8,294,400 之间。价格方面,来源列出的两款模型在图像输入、缓存输入和输出,以及文本输入、缓存输入上采用相同定价。
影响解读:AI 生图竞争进入“可控生产力”阶段
ChatGPT Images 2.5 的升级重点并不只是画质,而是围绕创作链路补齐速度、草图、模板、局部编辑和分享复现能力。这说明 AI 图像工具的竞争正在从“谁生成得更惊艳”转向“谁更适合真实生产”。
对普通用户而言,模板和草图降低了创作门槛;对专业用户而言,局部标注、多轮一致性和更高分辨率支持,才是能否进入营销、商品图、视觉原型等场景的关键。随着安全与溯源要求提高,OpenAI 也延续现有安全机制,对提示词和生成图像实施检查,并为所有输出嵌入 C2PA 元数据和隐形水印,用于识别由 OpenAI 工具生成的图像,减少未授权复用和深度伪造风险。
总体来看,Images 2.5 更像是 OpenAI 将图像生成能力产品化、流程化的一次更新。它不只服务于“生成一张图”,而是试图覆盖从构思、草图、生成、局部修改到分享协作的完整链条。