一句话:OpenAI 把所有 ChatGPT Work 和 Codex 用户的用量额度清零重算,同时让 GPT-5.6 Sol 少烧一点 token——官方给的数字是"典型使用下大约多撑 18%";此前因排查而暂停的五小时限额窗口,将于次日恢复。
这件事是 OpenAI 员工 Tibo Sottiaux 在社交平台上直接说的,没有走正式发布稿的流程。他的原话里有一句挺关键:"我们并没有下调任何订阅计划的用量。"这是在回应过去几周持续发酵的一个质疑——Sol 上线之后,不少人发现自己的 Codex 额度掉得比以前快,怀疑官方偷偷缩水了配额。
这次到底改了什么
拆开看是三件事同时落地:
- 额度重置:所有 ChatGPT Work 和 Codex 用户的用量计数归零,周期走到一半的人相当于白捡一段余量。
- 模型侧优化:针对 GPT-5.6 Sol 消耗过快做了多项改进,同样的活儿现在吃掉的配额更少,官方预计典型场景下能多撑约 18%,一部分用户即日起就能看到更明显的提升。
- 五小时限额回归:之前为了排查问题暂时停掉的五小时滚动窗口,官方说次日恢复。
换句话说,"限额被取消了"这个状态是临时的,不是新常态。真正长期留下来的红利是模型更省——这个 18% 才是可以按天算进日常工作节奏里的东西。
为什么 Sol 更费额度
官方给了解释,逻辑上说得通:Sol 这一代更倾向于长时间连续工作,会主动发起更多次工具调用,也更愿意去协调多步骤的复杂流程。在同等推理强度下,它比 GPT-5.5 消耗更多 token;而代码模式里的并行调用又进一步把用量推高了一截。
能力越强、越"敢干活"的模型,单位任务的成本反而更高——这算不上意外,但确实和很多人"新版本应该更便宜"的直觉相反。
比较少见的是官方的态度。Sottiaux 承认,发布前团队过度盯着平均值和中位数,忽略了重度用户那条长尾;并且表示本应更早察觉、也本应更坦率地沟通。这种承认"我们看错了指标"的说法,在这一轮 AI 厂商的公关口径里不算常见。
重度用户该怎么调整节奏
五小时窗口回来之后,那种"一口气怼到底"的用法又要重新面对节流。几条实际一点的建议:
- 把长任务拆开,别把一个跨越几小时的重构塞进单个会话里,中途断在窗口边界最难受。
- 非必要不开代码模式的高并行——并行调用是这次官方点名的耗量大户之一。
- 重置刚生效的这一两天余量最松,适合把攒着的大活儿先推一遍。
提醒:额度重置只是把计数器清零,不改变账号本身的风控状态。如果你的 Codex 之前就时不时报 Unusual Activity 或者直接连不上,那不是额度问题,得往网络环境上查。
对国内和代理用户意味着什么
这条消息对国内用户其实有个隐性前提:额度再宽松,也得先能稳定连上。现实里更常见的情况是——额度明明还剩一大半,Codex 却在跑到一半时突然掉线、重连后上下文全丢,或者网页端能用、命令行工具死活握不上手。这类问题基本都出在出口 IP 和域名分流上,跟配额没有半点关系。
几个高频坑,按出现频率排:
- 出口 IP 落地不干净:机房 IP、被大量共用的住宅代理,都会让账号被判定为高风险,表现为频繁验证、限流甚至直接封。可以先用 GPT / Codex IP 检测 看一眼当前出口的评级。
- 域名分流漏配:ChatGPT 网页端和 Codex 命令行走的域名并不完全重合,只代理了主站、漏了 API 侧域名,就会出现"网页能聊、Codex 报错"的割裂状态。具体名单参考 GPT 域名分流规则。
- IPv6 抢路:双栈环境下系统优先走了 IPv6,绕开代理直连,请求源地址一下子变成真实地址。排查方法见 IPv6 泄漏自查。
- IP 频繁跳变:长任务跑到一半出口地址换了,触发风控是常事。这类现象和封号的关联,封号与防封 里整理得比较全。
如果你打算趁额度重置这波多跑几个长任务,那更该先把网络环境理顺——中途断掉浪费的额度,比省下来的那 18% 多得多。Codex 命令行侧的具体配置建议,可以对着 Codex 稳定使用指南 逐条核对;账号已经开始报 Unusual Activity 的,先看 Unusual Activity 与 IP 风控 定位原因。
动手查一下:额度重置是白送的,稳定性得自己挣。花十几秒用
GPT / Codex IP 检测 跑一遍当前出口 IP 的风险评级、纯净度和落地位置,再决定要不要在这个环境下推长任务。检测全程在浏览器完成,不需要登录、不留记录。