9 月 1 日发布,模型 ID claude-fable-5-1。价目表只动了缓存读一格,但迁移前有三条改动会让老代码直接返回 400。
claude-fable-5-1),输入输出维持 $10 / $50 每百万 token 不变,缓存读取从 $1 砍到 $0.25,同时带来三处会直接让老代码报 400 的破坏性改动。传了大半个月的 Fable 5.1 落地了。官方文档给的发布日期是 2026 年 9 月 1 日,模型 ID claude-fable-5-1,Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 同步开放,所有客户可用。同期还有一个规格与定价完全相同的 Claude Mythos 5.1,但它只发给 Project Glasswing 的受邀客户,需要联系 Anthropic、AWS 或 Google Cloud 的客户团队。
规格上它跟 Fable 5 是同一套底子:100 万 token 上下文(默认即最大,全窗口统一按标准单价计费)、12.8 万 token 最大输出、自适应思考常开、默认 effort 为 high、可靠知识截止 2026 年 6 月。分词器沿用 Opus 4.7 那一版,同样的文本比 4.7 之前的模型多出约 30% 的 token。
整张价目表里唯一变化的是缓存读取。Fable 5.1 的缓存命中与刷新按基础输入价的 0.025 倍计费,而其他 Claude 模型是 0.1 倍。折成绝对值:
这个降幅对长会话是实打实的。粗算一笔:一个 20 万 token 的系统提示加代码库前缀,在一次跑几小时的 agent 会话里被反复读取 100 次,就是 2000 万 token 的缓存读;按旧价 $1 是 20 美元,按新价只要 5 美元。写入价没动,也就是说这次优惠精确地落在"同一份上下文被反复回看"这一种用法上——恰好是长程 agent 最主要的开销形态。
从 Fable 5 迁过来,有三处是破坏性的,光换模型 ID 不改代码会出问题。
第一条,强制工具调用被取消。tool_choice 设成 {"type":"any"} 或指定某个工具,直接返回 400 invalid_request_error,token 计数接口同样校验。官方给的理由是这个模型思考常开,而强制工具调用会跳过思考,模型会把推演过程写进工具参数里,反而拉低参数质量。想拿结构合法的 JSON,官方建议留在 auto 加 strict: true,或者干脆走 structured outputs;想让它一定调工具,就在提示里直接说清楚什么情况下用哪个工具。
第二条,思考块开始认模型了。每个思考块都记录自己由哪个模型产生,且只能单向传递:Fable 5.1 读得懂更早模型留下的思考块,反过来任何更早的模型都读不了它的。会话从 Opus 5 升到 Fable 5.1,推理链保得住;从 Fable 5.1 降回去,那几轮的推理就没了。做路由或 fallback 中途切模型的,API 会把读不了的块悄悄丢掉——不计费也不进 input_tokens,但默认不告诉你,要看见得带 thinking-binding-controls-2026-08-01 这个 beta 头,丢弃动作才会出现在顶层的 input_transformations 数组里。
第三条最容易踩,改历史会让后面的思考块全部作废。动了思考块之前的任何东西——system 提示、tools 数组、更早的某条消息——下一次请求就报 400,报错信息是 The block is bound to a different conversation。这条对 2026 年 8 月 31 日及以后创建的新账号是强制生效的;更早的账号 API 只记录不拦截,除非请求里显式设了 prefix_mismatch_behavior。
踩坑的写法官方列得很具体:把每轮的临时提醒注入到历史消息里、下一轮再删掉;两次请求之间重建 system 或 tools;重排或删掉中间某一轮。相对地,从最旧那头连续删思考块、让服务端做 context editing 或 compaction、挪 cache_control 标记、改 effort,这些都不算编辑。用 Claude Code、claude.ai、Managed Agents 或 Agent SDK 的人基本不用管,这几个客户端会替你保住前缀完整——真正要自查的是那些自己拼 messages 数组的集成。想省事就是一句话:把会话当成只能追加的日志,要加指令走 mid-conversation system message,要改工具走 mid-conversation tool changes。日常在终端里用它的话,Claude Code 稳定使用指南里那套配置思路依然适用,客户端这一层已经替你把历史管住了。
比破坏性改动更需要留意的,其实是那些不改代码也会自己发生变化的默认行为。官方文档一口气列了七条,其中三条直接关系到账单:
把这几条和价目表放在一起看,5.1 做的与其说是降价,不如说是把成本从输入侧挪到了轮次侧:缓存读便宜了四分之三,但更碎的工具调用和整文件重写吃的是 $50 一百万的输出价,比输入贵五倍。真实账单是涨是跌,取决于你的 agent 循环里"重复读上下文"和"反复吐内容"哪一头更重。迁完之后重跑一遍 eval,顺便对一下账,这一步省不掉。
另外几条不影响钱但影响观感:长任务里模型主动写的进度说明变少了,尤其在高 effort 下;行文更密,句子更长、分段更少;聊天里用粗体、标题和列表的频率低于以往的 Claude;总结文档时更容易原样复述原文而不打引号。UI 依赖旁白的产品要显式要求开场白、中途更新和收尾复述。
增量部分有四个 beta 特性加一项内容标识:
mid-conversation-output-config-2026-07-01):难的那一步调高、常规步骤调低,且不会让 prompt 缓存失效。Opus 5 也支持。mid-conversation-system-clear-at-2026-08-21):给 role: "system" 的消息设 clear_at: "next_user_message",它在当前这一轮带系统提示权重,之后自动停止渲染,消息本身留在 messages 里原样回传。这正是用来替代"注入再删除"那种会让思考块作废的写法的。thinking-display-updates-2026-08-18):把 thinking.display 设成 "updates",模型写的状态行以文本形式返回,推理本身仍然隐藏。默认的 "omitted" 下这些块是空的,长任务在用户眼里就是一片安静。值得说清楚的是官方自己给的选型建议:大多数负载仍然从 Opus 5 起步。Fable 5.1 的适用场景被限定在两类——高难度推理和长程 agent 任务,或者你在 Opus 5 上把 effort 拉高之后 eval 仍然不达标。价格差摆在那里:Opus 5 是 $5 / $25,Fable 5.1 翻了一倍,延迟档位也从"中等"掉到"更慢"。
能力提升官方点了六个方向:跨小时的长会话编码、文档表格幻灯片这类知识工作、多步网络研究、读 PDF 里嵌套的密集图表、100 万窗口内的长上下文串联,以及浏览器和桌面应用的操作可靠性。多语言表现与 Fable 5 持平。
官方给出的横向对比如下,各项提升幅度很不均匀。
| 基准(能力项) | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 科研 agent | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 agent 编码 | 55.8% Mythos 5.1 为 60.9% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 知识工作,计分制 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 电脑操作,宽松 / 严格 | 77.9% / 41.7% | 72.9% / 36.1% | 75.4% / 39.6% | — |
| Humanity's Last Exam 无工具 / 带工具 | 60.9% / 65.0% | 57.8% / 63.8% | 56.6% / 63.6% | — |
| AutomationBench 业务流程 | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 agent 编码 | 73.4% | 70.5% | 70.0% | 67.2% |
跨度最大的是科研 agent 那一栏:52.6% 对上一代的 24.7%,翻了一倍还多。这一项也恰好是 Fable 5 唯一明显落后于 Opus 5 的地方(24.7% 对 29.0%),说明 5.1 补的是上一代的短板,而非全线普涨。业务流程那栏同理,31.4% 对 17.1%,接近翻倍。
反过来看常规活儿,涨幅就小得多:CursorBench 3.2.0 从 70.5% 走到 73.4%,只多 2.9 个百分点;带工具的 Humanity's Last Exam 从 63.8% 到 65.0%,多 1.2 个百分点;知识工作那项 1853 分对 Opus 5 的 1824 分,差 29 分。这组数字和上面那节的账能对上——贵一倍的钱买的是长程和高难度任务,日常编码与常规问答上的差距,小到未必值回票价。
还有两条容易被忽略的合规项:Fable 5.1 和 Mythos 5.1 都是 30 天数据保留,除非 Anthropic 明确授权,否则不提供零数据保留;两者都属于 Covered Models。退役时间承诺不早于 2027 年 9 月 1 日。安全侧沿用与 Fable 5 相同的 stop_details 分类,被拒的请求返回 HTTP 200 加 stop_reason: "refusal",允许的 fallback 目标是 Opus 4.8 和 Opus 5,切模型产生的 prompt 缓存成本由 fallback credit 退回。