OpenAI发布ChatGPT Images 2.5:生图延迟减半,草图功能亮相
OpenAI推出ChatGPT Images 2.5图像生成模型,延迟最高降低50%,新增Sketch草图、模板库及图片内评论标注功能,API提供Flare和Sunburst两个版本,定价按尺寸与质量区分。
新一代图像生成模型:主打速度与细节
在图像生成领域,OpenAI 于今日(9 月 9 日)正式推出 ChatGPT Images 2.5,定位为当前最先进的图像生成模型。相比 2026 年 4 月发布的 Images 2,新模型在提升细节锐度、自然光照和纹理丰富度的同时,将图像生成延迟最高压缩了 50%。这一改进对于依赖实时交互的创作场景尤为关键,例如设计师在对话中快速迭代视觉概念时,等待时间将显著缩短。
据官方介绍,延迟的降低并未牺牲画质,反而在多个维度上实现了增强。这得益于模型架构的优化,使得推理过程更加高效。对于企业用户而言,这意味着可以更快地将图像生成集成到工作流中,提升整体生产力。
Sketch 草图与协作功能:降低创作门槛
功能层面,ChatGPT Images 2.5 引入了 Sketch 草图功能,用户可通过输入“@Sketch”调用。该功能允许用户直接在对话中绘制简单草图,并辅以风格和细节描述,模型即可将其转化为完整的图像作品。这为不具备专业绘画技能的用户提供了直观的创作入口,也为专业设计师提供了快速表达创意的工具。
此外,产品新增了模板库,涵盖海报、商品等常见创作格式,进一步降低了从零开始设计的门槛。在协作方面,新功能支持图片内评论标注,用户可以在图像的特定位置添加批注,例如圈出需修改的区域,并发出“删除此区域”或“将此改为蓝色”等指令。模型能够精准定位并仅修改指定区域,同时保持图像其余部分不变。在多轮编辑过程中,模型展现出更强的一致性保持能力,有效避免了反复修改后常见的细节退化问题,这对于需要精细调整的营销素材和产品图尤为实用。
API 双模型策略:兼顾通用与精细
针对开发者生态,OpenAI 在 API 中提供了两款图像生成模型,以满足不同场景的需求。其中,GPT-Image-2.5 Flare 面向多数 API 图像生成应用,适用于创作者内容、社交内容、产品体验、视觉搜索、快速原型和高批量生成等场景,强调速度与性价比。另一款 GPT-Image-2.5 Sunburst 则面向对编辑控制要求更高的专业工作流,适用于成品级营销素材和精修产品图,但生成时间相对更长。
API 支持多种分辨率输出,包括 1024×1024、2048×2048 以及 3840×2160(4K 横向)等,单边最长不超过 3840 像素,总像素数介于 655,360 至 8,294,400 之间。定价方面,两款模型均根据生成图像的尺寸和质量计费,具体价格如下:
- GPT-Image-2.5 Flare:1024×1024 低质量约 $0.019/张,中等质量约 $0.038/张,高质量约 $0.076/张;2048×2048 低质量约 $0.038/张,中等质量约 $0.076/张,高质量约 $0.152/张。
- GPT-Image-2.5 Sunburst:1024×1024 低质量约 $0.038/张,中等质量约 $0.076/张,高质量约 $0.152/张;2048×2048 低质量约 $0.076/张,中等质量约 $0.152/张,高质量约 $0.304/张。
在安全与合规方面,Images 2.5 延续了现有的安全机制,对提示词和生成图像实施双重检查,以防止有害内容输出。所有生成的图像均嵌入 C2PA 元数据和隐形水印,以便识别来源,从而打击未授权复制和深度伪造风险。
行业影响与趋势展望
此次更新折射出图像生成技术竞争的焦点正在从单纯的画质转向综合体验:更快的响应速度、更精准的编辑控制以及更完善的安全机制。Sketch 功能的加入,预示着人机交互方式正在向更自然的“画+说”模式演进,这可能吸引更多非专业用户参与 AI 创作。而双模型的 API 设计,则为开发者提供了更灵活的选择,有助于推动图像生成在电商、广告、内容创作等领域的规模化落地。随着模型能力的提升,如何平衡创新与滥用防范,仍将是所有参与者的重要课题。