← 返回 GPT / Codex IP 检测更多资讯 →

Codex 的 Luna 备用模型是怎么回事:5 小时上限后并非无限续杯

GPT 资讯 · 2026-08-28 · Net.Coffee

Tibo Sottiaux 确认了备用档的存在,但它是一层降级兜底——能力面比主力档小,余量条也说明不了你现在能不能起任务。

一句话:Codex 里确实有一个叫 Luna Reserve 的备用档,主力额度打空后可能自动接管,但它是降级兜底,不是"额度用完还能无限跑"的暗门。

8 月 27 日,负责 Codex 与 ChatGPT 工程的 Tibo Sottiaux 在 X 上回复用户,确认了 Luna 备用模型的存在。此前几周,桌面端用户陆续贴出截图:主力额度耗尽、界面本该拦下新任务的时候,Codex 反而切到一个标着 Luna Reserve 的档位继续干活,还带着一条属于它自己的余量条。这条确认把传闻坐实了,也顺手把"无限续杯"的想象按了回去——Tibo 明确说了,这不等于额度耗尽后可以随便用。

它在什么时刻接管

要看懂 Luna Reserve 的位置,得先看 Codex 现在这套限流是怎么叠起来的。今年 7 月 OpenAI 一度撤掉 5 小时滚动窗口、只留周额度,Plus 用户过了一段"只看周结算"的日子;8 月下旬 5 小时上限又被装了回来,官方给出的理由是这样能把算力负载摊平,从而把周额度留得宽一些——尤其是 Plus 里有不少新用户,一坐下就能把一周的量烧光。于是现在同时跑着两层计量:5 小时的短窗口,和一周的长窗口。

Luna Reserve 挂在短窗口下面。按客户端里观察到的行为,它会记住你原本选的模型,在高级模型额度打空之后临时替换成保留档,等 Reserve 这一段结束再把原来的选择换回来。这更接近流量套餐超额后的"降速不断线",而不是额外送你一份额度——你没有多拿到高级模型的调用,只是没被彻底挡在门外。

换上备用档之后,少的不只是速度

GPT-5.6 这一代在 Codex 侧摆了 Sol、Terra、Luna 三档,Luna 是最轻的一档,官方定位偏向清晰、可重复、能用客观标准校验的高频活儿。轻档位的代价是能力面收窄:多位用户实测反馈,切到 Luna 之后,Sol 与 Terra 那边的浏览器操作、网站检查一类能力并不跟着过来。

这一点最容易被误判。看到还能继续发指令,人会默认"一切照旧、只是慢一点",于是把一个需要打开页面、抓实时内容来核对的任务照常派下去——结果不是慢,是那一步根本执行不了,返回的东西看着完整,实际是绕过验证写出来的。真要在额度紧张时压缩损失,与其等它自动降级,不如提前把依赖工具链的步骤排到主力档跑完,剩下的机械活留给备用档;Codex 稳定使用指南 里那套模型与任务分配的思路,在这种场景下反而比平时更值钱。

余量条显示 90%,任务却起不来

另一个被反复提到的现象出在 ChatGPT Work 网页端:界面上 Luna Reserve 还剩九成左右余量,新任务却启动不了;不同用户看到的额度重置时间也对不上。

把两层计量摊开就不难理解——Reserve 的那条余量条只是它自己那一层的读数,上面还压着周额度,以及网页端与桌面端各自的任务准入判断。三者刻度不同、重置节奏也不同步,任何一层卡住,前台都只表现为"起不来"。所以那根进度条能回答的是"备用档还剩多少",回答不了"我现在能不能开工"。

还要补一句前提:上面这些细节大多来自社区实测截图与支持渠道的零散回复,OpenAI 并没有把 Luna Reserve 写成一份公开的额度承诺。行为随时可能调整,把它写进工作流里当固定资源是有风险的。

把它当缓冲,别当储备罐

Luna Reserve 真正的价值,是让"额度用尽"从一堵墙变成一个斜坡——手上那件事还能收个尾,不至于半途断在那里。它值得知道,但不值得拿来做额度规划:一旦按"反正还有 Reserve"的心态排活,等于把最需要能力的那部分任务推到了能力最弱的档位上。

顺带说一个容易混进来的变量。桌面端"起不了新任务"并不总是额度问题,出口 IP 或分流没走对时,前台给的同样是一句语焉不详的失败。分不清是被限流挡下还是被风控挡下的时候,先确认出口本身干不干净——GPT / Codex IP 检测 给出的落地判定,至少能把其中一半可能性排掉,剩下的再去看那根进度条也不迟。