2026-09-10 09:41 1006 次浏览

ChatGPT语音模式开放模型自选,Pro用户可调用GPT-5.6 Sol与GPT-6 Astra

OpenAI语音产品负责人Atty Eleti宣布,ChatGPT语音模式允许用户自选模型与推理深度,Pro套餐可调用GPT-5.6 Sol或GPT-6 Astra。GPT-Live每日限额规则同步简化,原有三档语音智能等级停用。

语音交互进入模型自选阶段

OpenAI在语音交互层面迈出关键一步。语音产品负责人Atty Eleti对外披露,ChatGPT语音模式(ChatGPT Voice)现已允许用户自行指定底层模型及推理深度,Pro套餐订阅者可直接调用GPT-5.6 Sol或GPT-6 Astra。这意味着语音对话不再是固定管线的黑盒输出,而是将模型选择权交还给使用者。

当语音请求涉及网络搜索或复杂推理任务时,系统会依据用户预先指定的模型进行转发处理。按照Atty Eleti的说法,每一次语音模式将问题交由底层文本模型处理,都等同于向该模型发送一条独立消息。这一机制让语音通道与文本模型之间的调用关系更加透明,也为后续计费与限额管理提供了统一口径。

GPT-Live限额规则全面简化

与模型自选同步落地的,是GPT-Live每日使用限额规则的调整。此前分散的额度体系被重新梳理,不同订阅档位对应差异化的使用时长:

  • Go套餐:提供最长3小时的GPT-Live-1 mini使用时长,不再包含GPT-Live-1的访问权限。
  • Plus套餐:提供最长3小时的GPT-Live-1使用时长。
  • Pro(100美元/月):提供最长15小时的GPT-Live-1使用时长。
  • Pro(200美元/月):GPT-Live-1无限制使用。

另一项值得注意的变化是,Plus与Pro用户在用尽语音额度后,将不再降级切换至GPT-Live mini。同时,原有的“Instant / Medium / High”三档独立语音智能等级已正式停用,语音交互的智能档位不再作为独立选项存在,而是通过模型与推理深度选择来间接体现。

行业视角:语音入口的模型分层逻辑

从产品设计看,此次调整将语音模式从“单一智能等级”推向“模型+推理深度”的二维选择。对高频语音用户而言,Pro档位的高时长乃至无限制额度,实质上是在为语音作为主力交互入口铺路。而Go套餐移除GPT-Live-1访问权限,则进一步拉开各档位之间的能力差距。

在语音与文本模型边界日益模糊的背景下,OpenAI正尝试用统一的模型调用框架来管理语音请求。语音不再是一个独立于文本之外的子系统,而是文本模型能力的一种输入输出形态。这种架构思路若被延续,未来语音模式的模型切换、额度消耗与推理成本核算都将更贴近文本API的运作方式。对于依赖ChatGPT语音能力的开发者与重度用户来说,理解各档位的模型可用范围与限额规则,将成为优化使用成本的必要前提。