2026-09-09 04:42 1003 次浏览

ChatGPT图像生成迎重大更新:草图直出与局部批注成亮点

OpenAI发布ChatGPT Images 2.5,新增Sketch草图生图功能,支持用户手绘后生成精细图像,并可局部批注修改。新版本在光线、纹理及指令跟随方面均有提升,延迟较2.0降低最多50%,已面向多平台用户开放。

图像生成赛道再添新变量。OpenAI于周二宣布对ChatGPT内置图像生成工具进行重大版本更新,推出ChatGPT Images 2.5,并同步引入一项名为Sketch的全新交互方式。此举意味着用户不再需要依赖纯文本提示词,而是可以直接在对话界面中绘制草图,再由系统将其转化为细节丰富的成品图像,为创意工作流提供了一种更为直观的起点。

草图即提示:从涂鸦到写实图像的跨越

此次更新的核心在于Sketch功能的加入。用户只需在ChatGPT聊天框中输入@Sketch并唤起绘图窗口,即可使用鼠标或触控笔勾勒出大致轮廓,随后通过自然语言描述期望的成品风格或场景。系统会基于这些手绘线条与文字指令,综合生成符合要求的图像。

实际测试显示,这一功能具备相当的可用性。据外媒记者Jay Peters的体验,他用鼠标随手画出的猫咪涂鸦,成功被转化为一张写实风格的照片。更值得注意的是,用户还能在生成后的图片上直接进行标注式修改——例如圈出猫眼并写下“改为绿色”,系统即可精准执行局部调整,并支持后续再次修改。这意味着ChatGPT的图像理解能力已从整体生成延伸至区域级编辑,交互逻辑更贴近修图软件中的批注操作。

技术升级:更自然的光影与更低的延迟

除Sketch外,OpenAI还披露了ChatGPT Images 2.5在底层生成质量上的改进。官方表示,新版本生成的图像拥有“更自然的光线”和“更丰富的纹理”,在多轮编辑指令的跟随能力上亦有增强,能够更稳定地处理用户连续提出的修改要求。性能方面,图像生成延迟相比Images 2.0最多可降低50%,这对于追求效率的批量创作场景尤为重要。

目前,ChatGPT Images 2.5已面向ChatGPT、ChatGPT Work及Codex用户开放,覆盖桌面端、移动端和网页端。这一广泛的可用性策略,有望让更多用户在真实工作流中检验新功能的实际表现。

行业观察:生成式工具正走向“混合交互”时代

从纯文本生成,到支持涂抹式编辑,再到如今的草图直出,图像生成工具的交互范式正在经历快速演变。Sketch功能的推出,反映出业界对“视觉语言”输入的重视——并非所有创意想法都能用文字精准描述,而草图提供了一种低门槛的补充表达方式。同时,局部批注修改能力的落地,也预示着AI图像工具正从“一次性生成”向“可精细调控的创作伙伴”角色转变。

可以预见,随着这类混合交互模式(文字+草图+区域指令)的成熟,AI图像生成将更深入地融入设计、营销、内容创作等实际生产流程。对于开发者与站长而言,关注此类工具能力边界的扩展,或许能更早捕捉到应用创新的机会。