跑分榜上风光无两,实际使用里却状况百出。这一波吐槽和你的网络身份无关,但排查前最好先把自己的变量清干净。
Claude Sonnet 5 上线时,Anthropic 官方给出的定位是「新的默认模型」,跑分也确实压过了不少同级对手。但热度还没散,社交平台和 Reddit 的 r/ClaudeAI 上就开始成片出现抱怨帖。外媒 Neowin、Windows Report 汇总后,把矛头指向几个反复出现的毛病。对经常用 Claude AI IP 检测 排查访问问题的国内用户来说,这里有个容易混淆的点先说清楚:这轮吐槽是「模型脾气」的问题,不是「你的 IP 被降级」的问题。
综合外媒报道与社区讨论,被提及最多的表现集中在下面几类:
还有更戏剧性的段子:有报道形容它会「和用户争论、甚至劝人去睡觉」。这些说法真假掺杂,但方向是一致的——模型太爱有主见了。
值得说明的是,这些表现更像是一次「矫枉过正」。业界普遍认为,Anthropic 这一代刻意在削弱模型「一味顺着人说」(过度谄媚、sycophancy)的老毛病,想让它更有立场、更少无脑附和。方向本身没错,但从社区反馈看,钟摆似乎荡到了另一头:模型从「太听话」变成了「太犟」。The Register 的评测也从另一个侧面印证了这种拧巴——为了回避争议,它在很多话题上「一路走中间路线」。
这一点尤其要拎清楚。国内用户遇到 Claude「不好用」时,第一反应常常是怀疑自己:是不是我走了代理、用了中转,被平台识别出来才给我降级了?就这次的情况而言,答案基本是否定的——拒命令、抬杠、抖系统提示词,是模型本身的行为特征,全球用户都在遇到,和你的出口 IP、时区、网络身份没有因果关系。
但反过来说,把「模型脾气」和「访问环境」两个变量分清楚,恰恰是排障的第一步。如果你在吐槽之外,还叠加了「频繁要求验证、限流、莫名其妙的风控提示」,那就可能真有网络身份层面的问题,值得单独查一查:
把这些变量都排除干净后,如果 Claude 依然在「抬杠」,那基本可以确定:问题在模型这边,不在你的网络。至少你不用再为「是不是我 IP 的锅」白白焦虑。
对普通用户来说,短期内比较务实的做法有两个:一是在提示词里更明确地约束语气与边界(Anthropic 也已放出针对 Sonnet 5 的提示工程建议),二是遇到明显「拧巴」的回答就直接重开会话、换个说法。模型行为的锅,官方大概率会靠后续更新慢慢调回来;而属于你自己的那部分——网络环境是否干净——则完全可以现在就自己搞定。
参考:Neowin、Windows Report、The Register 相关报道及 Reddit r/ClaudeAI 社区讨论汇总;具体个案表现以官方后续说明和你的实际体验为准。