← 返回 GPT / Codex IP 检测更多资讯 →

OpenAI 研究员日均 token 账单中位数已过 600 美元

首页AI 资讯OpenAI 资讯 · 2026-09-08 · Net.Coffee

内部消耗按 API 标价折算,九十分位一天超过 7000 美元;同期 token 单价刚刚跌破 1 美元

先说结论:OpenAI 这次公开的不是产品数据,是一份自家账本——研究组织里,一个人干一天活的同时,智能体在旁边干掉了 3.1 天的量,按 API 标价折算,日均推理消耗中位数已经越过 600 美元。

600 美元是按什么算出来的

这个数字的口径需要先说清楚,否则很容易被读成「OpenAI 每天给每个研究员付 600 美元」。官方博客给出的表述是:到 8 月中旬,研究组织里的中位数研究员每天都在用智能体,按对外 API 价格折算,日均推理消耗超过 600 美元;处在九十分位的高强度使用者,这个数字超过 7000 美元。

换句话说,这是把自家算力按对外报价记了一笔账。真实的边际成本对 OpenAI 来说要低得多,它没有为这些 token 向任何人付钱。但这笔虚拟账单反而更有参考价值——它等于告诉外部开发者:如果你想让一个人的产出接近我们研究员现在的强度,按现价你要准备多少钱。

三个半月,从「不如人」到「三倍于人」

最能说明速度的其实不是绝对值,而是那条越线的时间。按官方说法,在 2026 年 6 月之前,整个研究组织里智能体的总运行时长还低于人类总工时;到 8 月中旬,比例已经是 3.1 比 1。中间只隔了两个多月。

这条曲线之所以能这么陡,靠的不是单个模型突然变强,而是并发。研究员不再是「问一句等一句」,而是同时挂着好几个会话让它们各跑各的——官方原话说的是研究员整天都在用编码智能体,且常常是并发会话。人的注意力没有变多,变的是一个人能同时监督几条流水线。成本会跟着并发数近似线性上涨,产出却未必,这也是这类数字最容易被误读的地方。

那个「124 倍」的说法,各家转述对不上

中文渠道流传的版本里有两个更抢眼的数字:研究员输出 token 相比 2025 年 11 月增长 124 倍、约七成研究员同时跑至少 4 个智能体。这两项在能查到的一手表述和多数英文转述里没有对应上:更常被引用的一组是按团队拆分的中位数增长——研究团队约 56 倍、客服约 32 倍、工程约 27 倍、法务约 13 倍,基线同样是 2025 年 11 月。

倍数差出一倍多,通常不是谁在编,而是口径不同:算中位数还是算总量、只算 Codex 还是算全部推理、按团队拆还是按全组织合并,结果能差出好几档。所以引用时最好带上口径,单独甩一个「124 倍」出来意义不大。这里能确认的只有一点:以 2025 年 11 月为基线,一年不到,内部输出 token 是数十倍级的增长,而不是百分之几十。

单价在腰斩,账单在翻倍

把这份账本放到价格曲线上看会更有意思。据 IT Pro 的梳理,同一档能力的 token 价格在 6 月还是每百万 2 美元,到 9 月 5 日已经跌到 0.99 美元——三个月腰斩。单价砍半,人均日消耗却还在往上走,说明需求这边的弹性远远盖过了降价。

这不只发生在 OpenAI 内部。外部报道提到,Uber 用了四个月就把全年 AI 预算花完;Gartner 则给出过一个更刺眼的预测:到 2028 年,单个开发者的 token 花费有可能超过其平均薪资。这些数字来源不一、可靠性有别,但方向是一致的:降价没有降低总支出,只是把「买得起多少并发」这条线往上抬了一格。

这份账本里唯一没被公开的是分母。OpenAI 给了投入侧的全部刻度——多少钱、多少工作日、多少倍增长——却没有给出对应的研究产出如何计量。它自己也在博客里提醒这些是内部指标、不是通用生产力基准。在这个分母补上之前,3.1 这个比值更像是一份消耗强度报告,而不是效率证明。