同一份公告里藏着两件方向相反的事——付费档拿到更强的模型和一个可以自己拧的思考旋钮,免费档拿到的是"随便聊",但聊天的对象被固定成了最小的那个。
此前 ChatGPT 的"快速回答"和"深度思考"是两条不同的路子,前者更像即时反应,后者才调动推理。这次改动把 Plus 和 Pro 用户的两端都换成了 GPT-5.6 Sol,官方给的形容词是回答更聚焦、格式更收敛、事实更靠得住。
更实际的变化是那个滑块。它出现在网页、移动端和桌面端,作用是让用户自己决定这次提问值得模型想多久——以前这件事由系统替你判断,判重了浪费时间,判轻了答案发飘。把开关交出来,等于承认自动路由没那么准。这也是过去一年整个行业都在做的一件事:从"我们帮你选模型"退回到"你自己选"。
免费与 Go 用户这一侧的时间线分成两步:
"不限量"三个字很好听,但要和另一半一起读。Luna 是 GPT-5.6 家族里最轻的一档,免费用户过去偶尔还能蹭到更高规格的模型,现在换成的是次数管够、天花板压低。海外媒体 the-decoder 直接把这次调整概括成把免费用户限制在最弱的模型上,措辞虽然刺耳,但描述的是同一件事的另一面。
从成本角度这个交换很合理:小模型单次推理便宜得多,放开次数带来的边际支出可控,而"无限"这个卖点对拉新和留存的作用远大于偶尔一次高规格回答。真正需要推理的人会去按 Think 按钮,而按下去多半就撞上另一层限制——这也是 Think 按钮存在的意义,它是免费档的计量阀门。
官方给出的数字来自内部评估:在财经、医疗、法律这类需要事实细节的提问上,回答中至少包含一处事实错误的比例,GPT-5.6 Luna 比 GPT-5.5 Instant 低约 62%,GPT-5.6 Sol 低约 68%。
有两点值得留意。其一,这是相对降幅,不是错误率本身,基线绝对值官方没公布——原来一百个回答错三十个,降 62% 之后还有十一个多,落到用金融或医疗提问的人手里仍然不是可以闭眼相信的水平。其二,挑的三个领域恰好是错答代价最高、也最容易被截图传播的领域,选题本身就带着风险管理的意味。这不影响数字的真实性,但决定了它该被怎么读。
公告同时提到针对 18 岁以下用户加强了安全训练与系统级防护,限制浪漫角色扮演、涉及年龄限制的挑战类内容和其他不当内容,并在用户需要支持时引导其寻求现实中的人际联系。
把这段和"免费无限对话"放进同一篇发布说明,顺序上并不偶然:门槛降到零、次数放开之后,进来的必然有大量未成年用户,聊天时长也会拉长。先把防护写进公告,是在放开闸门之前先摆出态度。
对每天靠 ChatGPT 干活的人来说,这次更新里最需要适应的其实是滑块——它把"这道题值不值得等"从系统的判断变成你的判断。至于账号那一侧,无限对话意味着单个账号的请求密度会明显上升,而系统最先盯上的往往不是你问了什么,而是你从哪儿连进来的;连接环境是否稳定,可以先在 GPT / Codex IP 检测页面看一眼再决定要不要折腾。