十个至少十年没有主要进展的开放问题,token 成本约 2000 美元;OpenAI 请数学界来审视这批结果。
8 月 1 日,OpenAI 挂出一份题为《数学与理论计算机科学的十项进展》的公告,说这批结果来自下一代模型 Astra 的一个内部版本。这次不是刷竞赛题,也不是跑基准榜,而是十个"至少十年没见到主要进展"的开放问题,其中不少更久。
官方清单横跨好几个方向,公开材料里能对上的包括:
比结果更容易被拿出来讨论的是过程。OpenAI 提到,找到这些解法所消耗的 token,按 Sol 的 API 价折算大约 2000 美元。对照这些问题在人类学术圈里被反复啃了十几二十年,这个数字本身就足够刺眼。
流程是三段式:模型先产生论证;人类研究者与同一个模型协作,把论证整理成可读的论文手稿;再由模型把每条论证在 Lean 里形式化,生成能被机器检查的证书。OpenAI 这次把话说得比较直白——数学论证本身由 AI 生成,人类做的是整理和形式化,署名与归属应当如实反映结果真正的来源。
过去一年,"AI 解开未解数学难题"这类标题出现过不止一次,其中一部分后来被发现问题早有文献,或者证明本身有洞。这回 OpenAI 主动做了两件降风险的事:一是把论证形式化进 Lean,正确性交给机器检查,而不是靠公关稿背书;二是公开喊话,希望数学界深入审视这批成果。真正的结论要等同行评议给,短则数周,长则数月。
另一条背景是 Astra 本身。近期多家媒体报道称 OpenAI 正在准备这一代新模型,主打多智能体长周期协同,用来啃大型项目和高难问题,也有说法称它疑似就是外界口中的下一代 GPT。这些命名与定位目前都还没有官方确认,看看就好。
每次这种量级的进展公布,紧接着就是一波"我也想试试"。但对国内用户来说,能不能用上从来不是账号问题,而是网络出口问题。新模型上线初期往往先给 Pro/Plus 分批放量,并且对异常流量的容忍度更低——这时候一个被标记的出口 IP,比额度不够更容易把人挡在门外。
常见的三类坑:一是出口 IP 落在机房段或被大量共用,登录后频繁弹 Unusual Activity;二是 域名分流规则没配全,auth、api、cdn 几个域走了不同出口,会话直接被判异常;三是 IPv6 泄漏导致真实位置和代理出口对不上,可以先用 IPv6 泄漏检测确认一下。
最稳妥的顺序是:先去 GPT / Codex IP 检测把当前出口跑一遍,看是否被判定为高风险;再对照 Unusual Activity 与 IP 风控确认账号侧的表现;命令行侧用 Codex 的,另外看一眼 Codex 稳定使用指南;如果已经出现过验证循环或限制提示,封号与防封那篇里的处理顺序更实用。