Claude Fable 5.1 已于 2026 年 9 月 1 日发布,Claude API 模型 ID 是 claude-fable-5-1。它面向高难度推理、长时间 Agent、复杂研究和知识工作,拥有 1M token 上下文与 128K 最大输出。
这次升级不能只看“更强”或“最高省 45%”。Fable 5.1 延续 Fable 5 的 $10/$50 每百万输入/输出 token 单价,成本变化主要来自缓存读取;同时,tool_choice、thinking block 和对话历史处理出现了可能让现有客户端报错的变化。准备接入时,应该把它当成一次 API 版本迁移,而不是把模型名替换掉就结束。
Fable 5.1 的官方规格与提供范围
Anthropic 的Fable 5.1 模型页将它标记为 active,并列出 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS。
| 项目 | 官方规格 |
|---|---|
| Claude API ID | claude-fable-5-1 |
| Amazon Bedrock ID | anthropic.claude-fable-5-1 |
| 上下文窗口 | 1M token |
| 最大输出 | 128K token |
| 标准输入 / 输出价 | $10 / $50 每 MTok |
| 5 分钟 / 1 小时缓存写入 | $12.50 / $20 每 MTok |
| 缓存读取 | $0.25 每 MTok |
| Thinking | Adaptive,始终开启 |
默认 effort | high |
| 可靠知识截止 | 2026 年 6 月 |
“API 已提供”不等于每个入口都同时可见。Claude.ai、Claude Code、不同地区账户、IDE 和第三方网关各有自己的模型选择、计划、限额和上线节奏。找不到模型时,先核对所用产品、账户、地区与实际 endpoint,不能从 API 文档推断所有入口。
知识截止也不等于实时知识。任务涉及当日价格、政策、新闻或软件版本时,仍应提供最新资料或检索工具。
价格没变,缓存读取降到四分之一
Fable 5.1 的普通输入、输出和缓存写入价格与 Fable 5 相同。真正下降的是 cache read:它从基础输入价的 0.1 倍降到 0.025 倍,也就是每百万 token 从 $1 降到 $0.25。
这对反复读取稳定前缀的工作最有价值,例如:
- 长会话持续复用系统指令和工具定义;
- 编码 Agent 多轮读取仓库说明与相同文件;
- 研究任务在多个步骤中反复引用同一批资料;
- 文档、表格和幻灯片任务持续使用一组背景材料。
一次性请求、缓存命中很少的任务不会自动获得同样幅度的降价。Anthropic 在发布说明中估算,按 token 计费的典型 Fable 工作负载总成本约低 25%,高度依赖上下文和工具的 Agent 工作负载最高可低约 45%。这些数字来自 Anthropic 对 2026 年 8 月四周使用量的统计,取决于 cache read 占比、effort 与任务构成,不是固定折扣。
预算时应拆开记录普通输入、缓存写入、缓存读取、输出、工具费用、人工检查和返工,再计算:
单次合格结果成本 = 总模型与人工成本 ÷ 通过验收的任务数

能力提升集中在哪里
Anthropic 将 Fable 5.1 的改进集中在长时间 Agent 编码、多步研究、文档与表格处理、密集图表和 PDF 视觉理解、长上下文关联,以及浏览器和桌面操作。
发布材料还列出了 Terminal-Bench-Science 0.1、Terminal-Bench 4.0、GDPval-AA v2、OSWorld 2.0、AutomationBench 和 CursorBench 3.2.0 等结果,其中 Fable 5.1 多项高于 Fable 5。它们使用 Anthropic 指定的测试版本、执行环境、effort 和安全设置,适合说明“值得进入候选”,不能证明它一定会在你的代码库或资料上获胜。
同样重要的是行为差异:
- 独立工具操作可能拆成多个回合,增加往返时间;
- 高
effort下,长任务的用户可见进度说明可能更少; loweffort 更可能依靠已有知识,而不是主动搜索最新资料;- 小改动更容易变成整文件重写;
- 文本可能更密,格式层级比旧模型少。
这些表现只有影响任务完成时间、token、审核成本或用户体验时才是问题,应在实际运行环境中记录。
从 Fable 5 迁移会遇到三个破坏性变化
Anthropic 的变更说明列出三个必须检查的兼容问题。
1. 不再支持强制工具调用
以下 tool_choice 会返回 HTTP 400:
json{"type": "any"} {"type": "tool", "name": "lookup_order"}
错误信息是:
texttool_choice: type "tool" and "any" are not supported for this model.
保留默认的 {"type":"auto"}。需要结构化结果时,使用 strict tool use 或 structured outputs;必须调用工具时,在指令中清楚说明适用条件。
2. Thinking block 只保证单向兼容
Fable 5.1 可以读取较早 Claude 模型产生的 thinking block,但较早模型不能读取 Fable 5.1 的 block。同一对话回退到旧模型时,API 可能在请求到达模型前移除这些 block;未启用相应 beta 控制时,这项转换可能不会显式报告。
3. 改写前面的历史会破坏绑定
保留后续 thinking block 时,如果修改之前的消息、system、tools 或文档 bytes,请求可能返回:
textThe block is bound to a different conversation
长会话应采用只追加设计:新指令放在后面,工具变化使用中途更新,裁剪交给服务端 context editing 或 compaction。不要删除前面临时注入的提醒,也不要悄悄重建 system 或 tools。
新能力也带有明确的 beta 条件
Fable 5.1 支持按消息调整 effort、单回合 system message,以及在工具调用之间返回可读进度更新。这些能力需要文档指定的 beta header,不应在未检查平台支持时直接写进生产请求。
它的文本输出带有 Anthropic 的统计水印;通过 Claude Files API 取得的受支持图片或视频文件可包含 C2PA Content Credentials。模型当前采用 30 天数据留存,除非 Anthropic 明确批准 zero data retention。Enterprise Frontier Safeguards 是分阶段推出的企业能力,不能把未来计划写成所有账户当前都具备的 ZDR。
拒绝请求时也要检查响应体。Fable 5.1 可能返回 HTTP 200,同时带有 stop_reason: "refusal"。HTTP 成功只证明请求到达并返回,不能证明任务完成。

用小范围、可回退的迁移确认价值
先选一组真实任务,每项都要有可观察的合格条件,例如测试通过、JSON Schema 有效、文档数字与来源一致,或浏览器步骤完整结束。保持输入、工具、权限、超时与停止条件一致,再比较 Fable 5 与 Fable 5.1,或与当前生产模型对照。
迁移顺序可以很简单:
- 在少量流量中把模型 ID 改为
claude-fable-5-1; - 移除强制
tool_choice,保持工具 schema 严格; - 原样回传 thinking block,不修改对话前缀;
- 重新选择
effort,观察工具调用是否仍按预期并行; - 记录 cache read、输出、工具错误、P50/P95、人工修改和返工;
- 保留旧配置,出现异常可以立即回退。
如果 Fable 5.1 只在少数长任务上明显提升,就只让那些任务使用它。如果缓存读取确实占账单的大头,并且合格率、延迟和人工成本都保持改善,再逐步扩大。
当问题变成“整个 Claude 家族该从哪款开始”,可以继续查看独立的 Claude Fable、Opus、Sonnet 与 Haiku 选型指南。本页只回答 Fable 5.1 本身的规格、变化与迁移。



