← 返回 GPT / Codex IP 检测更多资讯 →

DeepSeek-V4-Pro 正式版上线:原生适配 Codex,API 改峰谷定价

GPT 资讯 · 2026-08-14 · Net.Coffee

模型名不变、Codex 一键接入,真正要看的是 8 月 17 日 0 点生效的新价格表

一句话:DeepSeek 8 月 13 日上线 V4-Pro 正式版,API 原生支持 OpenAI 的 Responses API 并提供 Codex 一键配置;同时宣布改用峰谷定价,北京时间 8 月 17 日 0 点生效——按官方价格表算,打了对折的"谷时"依然比现在贵。

V4-Pro 正式版在 8 月 13 日同步推到了 APP、网页端和 API 三端,网页端对应"Expert Mode",API 的模型名仍是 deepseek-v4-pro,老代码不用改一行。官方点名的两处变化都值得展开:思考深度拆成 low / high / max 三档,官方建议 low 给简单任务、high 给日常 Agent 工作流、max 留给复杂任务;API 则原生支持 OpenAI 的 Responses API 格式,并针对 Codex 做了适配,附带一键配置脚本。

"原生支持 Responses API"省掉的是哪一层

过去想让 Codex 这类客户端接上非 OpenAI 的模型,中间一般得垫一个转换层:把 Responses API 的请求翻译成对方的 Chat Completions 格式,再把流式返回、工具调用、推理内容逐字段翻回去。这层翻译最容易在两个地方掉链子——多轮工具调用的状态对不上,以及模型的推理过程在往返中被丢掉。DeepSeek 这次是在服务端直接认 Responses 这套请求与响应结构,相当于把翻译层从用户那边搬进了自己的接口,客户端改掉入口地址和密钥就能跑。

对已经在用 Codex 命令行的人来说,换后端的门槛从"自己折腾一个代理服务"降到了"跑一段配置"。这条路 DeepSeek 不是第一次走,7 月底 V4-Flash 正式版就已经开始适配 Codex,V4-Pro 这回是把能力线补齐。

峰时正好压在国内的上班时间

新价格的生效时间是 2026 年 8 月 16 日 16:00 UTC,也就是北京时间 8 月 17 日 0 点。官方定义的峰时为 UTC 01:00–04:00 与 06:00–10:00,换算成北京时间是 09:00–12:00 和 14:00–18:00,其余时段按谷时计。

这个切法很直白:一天里被标成"贵"的那两段,正好是国内开发者的上午和下午。想吃到谷时价,要么把批量任务挪去午休和深夜,要么接受白天按峰时结算。对着屏幕交互式写代码的人基本没得选——总不能为了半价把手上的活推到凌晨。

官方说的"低一半",参照系是新峰时

DeepSeek 的原话是谷时比峰时低 50%,这句话本身没错,但参照的是新的峰时价,不是眼下正在跑的价格。把官方价格表拉平了看(美元 / 百万 token,输入按缓存未命中计):

换句话说,最便宜的谷时输出价是现行价的 2.3 倍上下,峰时接近 4.5 倍。V4-Flash 的走向一样,谷时输出 0.66 对现行的 0.28。最扎眼的是缓存命中那一栏:0.003625 涨到谷时 0.022、峰时 0.044,跨度大约 6 到 12 倍。

而缓存命中恰恰是 Agent 工作流的主力项。Codex 那种循环,每一轮都要把之前的文件内容、工具输出和对话历史重新送一遍,绝大多数 token 都落在缓存命中上——过去这部分近乎白送,长上下文的自动化任务才跑得起来。这一栏涨十倍,账单结构会整个变形:越是放手让模型自己连着干活的用法,涨幅越大。反过来,一问一答式的用法受的影响要小得多。

换了后端,剩下的那半个问题

把 Codex 的模型指向 DeepSeek,解决的是"用谁的算力、花多少钱"这一层。至于账号那一层——登录被判 Unusual Activity、官方端点连不上、出口 IP 被归到高风险段——跟后端换成谁没有关系,该拦的照样拦。真遇上了,先分清是网络侧还是账号侧的毛病更省事,在 GPT / Codex IP 检测上看一眼当前出口的判定,再决定是动网络还是改配置。