← 返回 GPT / Codex IP 检测更多资讯 →

ChatGPT 语音模式开放选模型,GPT-6 Astra 与 5.6 Sol 都能调

首页AI 资讯OpenAI 资讯 · 2026-09-10 · Net.Coffee

语音从一个固定的快模型,变成了一层可以换后端的交互界面;同时被改掉的,还有额度的计价单位。

先说结论:ChatGPT 的语音不再绑死在一个固定的快模型上。Pro 用户现在可以在语音里指定用 GPT-5.6 Sol 还是 GPT-6 Astra,并自己定推理档位;当这轮对话需要搜索或需要多想一会儿时,被调用的就是你选的那个模型。

消息来自 OpenAI 负责语音方向的 Atty Eleti,他在 X 上说官方正在更新语音里的「智能机制」,让用户自选模型与 effort 档位。措辞很轻,但改的是语音这条产品线最底层的一块:谁来回答。

语音过去只有一个大脑,现在多了一个开关

此前的实时语音是一套端到端的设计——音频进、音频出,中间那个模型是固定的,主打的是延迟。这么做的代价是能力上限被钉死:它可以流畅地陪你聊天,但遇到需要查资料、需要一步步推的问题时,你只能挂掉语音,回到文字窗口里再问一遍。

这次的改法不是把语音模型换成一个更聪明的,而是把语音拆成两层:前面那层继续负责听和说,保证你说完就有回应;后面那层在判断到需要搜索或需要推理时,交给你指定的 GPT-5.6 Sol 或 GPT-6 Astra 去处理。effort 档位归你控制,意味着延迟和质量之间那个平衡点,OpenAI 不替你选了。

这也解释了为什么这项能力先落在 Pro 上。让语音去唤起一个高 effort 的推理模型,等待时间会肉眼可见地拉长,成本更是另一个量级,只有对时间容忍度和付费意愿都靠上的那批用户,这笔交换才成立。

额度从「多少条」改成「多少小时」

同期被简化的是语音的每日限额规则。据国内媒体转述的官方说明,GPT-Live 的每日时长分档如下:

计价单位换成时长,比看上去更能说明问题。文字对话按条数或按 token 记账,是因为算力开销跟着输入输出的长度走;语音按小时记账,说明这条链路上有一份「只要连着就在烧」的开销——音频流的编解码、持续的会话状态、等你开口时那段沉默里模型也没闲着。Go 档只给 mini 版本,也是同一个逻辑:便宜的不是它答得短,是它每分钟更省。

它和上周那次模型选择器改版是同一件事

9 月 4 日起,付费档的模型选择器里出现了 GPT-6 Astra 和 GPT-5.6 Sol,原来分开的 Instant 与 Thinking 两个入口被折叠成同一个模型加一根 effort 滑杆。GPT-6 Astra 本身在 9 月 3 日发布,按批次开放,Pro、Business 和已由管理员开启的 Enterprise 先拿到,Plus 侧则是在部分场景里给限量额度。

两件事拼起来,方向是一致的:OpenAI 正在把「用哪个模型、想多久」从产品形态里抽出来,做成一根用户可以拨的旋钮,然后让这根旋钮出现在每一个入口——网页、Codex,现在轮到语音。代价是选择本身变成了一件需要学习的事,好处是它终于不再由某个默认值替你决定。

剩下一个语音特有的麻烦

文字窗口里,模型有没有真的推理是能看见的:有思考过程的折叠块,有耗时,有引用来源。语音没有这些。你在耳机里听到的只是一段流利的回答,它究竟是前端那层直接生成的,还是真的把问题转交给了 Astra,中间唯一的线索是那几秒沉默的长短。

把选择权交给用户,前提是用户能看到自己的选择起没起作用。语音这一层现在还没有这块显示器。