公告只说「超过 20%」,但三档价格降幅不一样,而且写着「促销」
OpenAI 在官方账号上把这次调整说得很短:在继续推进模型能力、同时改善效率的前提下,未来三个月内 GPT-5.6 Sol 的 API 与额度价格下调超过 20%。一句话带过的公告,落到账单上其实分了三档,而且降幅并不一样。
按开发者社区里的官方公告页,新旧价格是这样的(单位:美元 / 每百万 token):
输入端老老实实降了两成,输出端却直接少了三分之一。前沿模型的输出向来是账单里最贵的一段——尤其是开了长思考、模型自己先写一大段推理再给结论的那种用法。OpenAI 挑输出这一档下手,等于把最痛的地方按下去了。
举个具体的例子:一次调用输入 1 万 token、输出 2 千 token。旧价是 0.05 + 0.06 = 0.11 美元,新价是 0.04 + 0.04 = 0.08 美元,实际降幅约 27%——比公告说的 20% 更多,因为输出占了账单一大半。
反过来,如果你的活是把长文档塞进去做摘要、分类、抽字段,输出只有几百 token,那账单的构成几乎全是输入,省下来的就贴着 20% 那条线,没有额外惊喜。缓存输入降到 0.40 则是另一类人的好消息:agent 循环里系统提示词、工具定义、长上下文往往每一轮都原样重发,命中缓存的那部分现在便宜了两成,轮次越多越明显。
一句话,这次降价对「输出重」的场景是实打实的让利,对「输入重」的场景只是账面上的 20%。写代码、生成长文本、多轮自我修正的 agent 属于前者,检索问答和批量分类属于后者。
公告用的词是 promotional pricing——促销价,明确写着至少延续到 2026 年 11 月 21 日。已经有开发者在评论区直接问:三个月之后 Sol 的价格怎么算?这个问题目前没有得到官方回答。
这半句的分量不小。如果你在做的是给客户报价的产品,或者要按 token 成本反推定价,把模型成本模型直接压在促销价上是有风险的:促销窗口结束后价格回到 5/30 也说得通,继续维持也说得通,OpenAI 没给承诺。稳妥的做法是按促销价享受这三个月的实惠,按原价做长期预算。
另一条容易被忽略的边界是覆盖范围:降价适用于 API、符合条件的 ChatGPT Work 方案,以及 Codex 额度;Pro、Plus、Business 这三档订阅的用量计费维持不变。也就是说,动的是按量付费那一侧——开发者、自动化流水线、跑 agent 的人,而不是每月固定交钱的订阅用户。
多家外媒把这次调价归因于竞争:Anthropic 在编码与 agent 场景上的挤压,加上中国模型在价格上的持续下探,让前沿模型很难再按「稀缺品」定价。有意思的是,OpenAI 自己的说法是「在推进能力边界的同时改善效率」——把降价挂在效率上,而不是挂在竞争上。两种解释可以并存:推理成本这条曲线确实还在往下掉,而对手的存在决定了省下来的成本要不要让给用户、什么时候让。
对每天用 Codex 跑活的人来说,额度跟着降就是把长任务的门槛又往下挪了一格——同样的钱,能多跑几轮重构、多让模型自己改几遍。真正会吃掉这笔便宜的反倒不是价格:一个跑了二十分钟的任务在中途因为出口 IP 被判异常而断掉,重来一次的成本可比省下的三成贵得多,这也是长任务的稳定性配置比价格更值得先花时间调的原因。