卡在 7 月最后一天上线。对 Codex 用户来说,最值得注意的不是跑分,而是它把接口这一层直接对齐到了 Responses API。
deepseek-v4-flash 正式版 API 推入公测,官方称其 Agent 能力基准分已经超过自家更早发布的 V4-Pro-Preview,并且原生支持 Responses API 格式、针对 Codex 做了适配——改配置就能让 Codex 跑第三方模型。按 DeepSeek 官方公布的数据,这一版在几项偏 Agent、偏工程的基准上给出的成绩是:
值得留意的是模型本身几乎没动:官方说明里写得很清楚,DeepSeek-V4-Flash-0731 的结构和尺寸与此前的 preview 版保持一致,差别只在于重新做了一轮后训练。也就是说这次提升主要来自训练侧的调校,而不是换了架构或堆了参数。跑分向来只是参考,真实体感还得自己接上去跑几天才知道。
对国内开发者来说,更有信息量的其实是接口层。正式版原生支持 Responses API 格式——这套格式是 OpenAI 侧目前 Agent 类工具在用的接口形态,Codex 也走它。DeepSeek 官方文档里给了直接的接入路径:把 base_url 指向 https://api.deepseek.com,模型名填 deepseek-v4-flash,简单配置之后就能在 Codex 里用 DeepSeek 的模型。
这次更新只作用于 V4-Flash 的 API 接口,V4-Pro 的 API 以及 APP、网页端都没有变化;官方称 V4-Pro 正式版会「尽快」跟上。公告里还顺带提了一个叫 DeepSeek Harness 的精简模式,说是即将开放测试,细节暂时不多。
把工具和模型拆开看会清楚很多:Codex 是壳(CLI 与工作流),模型是芯。现在这个壳可以换芯了,于是出现两条路——
现实里大多数人是混着用的:日常任务丢给便宜模型,硬骨头还是回官方。这种情况下最容易出的岔子,是以为「我换了国内模型就不需要管网络了」,结果切回官方通道时撞上 Unusual Activity 提示或者登录卡死。真要排查,先去 GPT / Codex IP 检测 看一眼当前出口的判定结果,比逐个试错快得多。