AIFreeAPI Logo

Claude Fable 5.1:价格、API 变化与迁移指南

A
9 分钟阅读AI 模型指南

Fable 5.1 的基础 token 单价没有下降,真正便宜的是缓存读取;更重要的是,强制工具调用和 thinking block 的兼容规则发生了变化。

Claude Fable 5.1 的发布日期、API 规格、缓存价格、主要能力、兼容风险与安全迁移步骤

Claude Fable 5.1 已于 2026 年 9 月 1 日发布,Claude API 模型 ID 是 claude-fable-5-1。它面向高难度推理、长时间 Agent、复杂研究和知识工作,拥有 1M token 上下文与 128K 最大输出。

这次升级不能只看“更强”或“最高省 45%”。Fable 5.1 延续 Fable 5 的 $10/$50 每百万输入/输出 token 单价,成本变化主要来自缓存读取;同时,tool_choice、thinking block 和对话历史处理出现了可能让现有客户端报错的变化。准备接入时,应该把它当成一次 API 版本迁移,而不是把模型名替换掉就结束。

Fable 5.1 的官方规格与提供范围

Anthropic 的Fable 5.1 模型页将它标记为 active,并列出 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS。

项目官方规格
Claude API IDclaude-fable-5-1
Amazon Bedrock IDanthropic.claude-fable-5-1
上下文窗口1M token
最大输出128K token
标准输入 / 输出价$10 / $50 每 MTok
5 分钟 / 1 小时缓存写入$12.50 / $20 每 MTok
缓存读取$0.25 每 MTok
ThinkingAdaptive,始终开启
默认 efforthigh
可靠知识截止2026 年 6 月

“API 已提供”不等于每个入口都同时可见。Claude.ai、Claude Code、不同地区账户、IDE 和第三方网关各有自己的模型选择、计划、限额和上线节奏。找不到模型时,先核对所用产品、账户、地区与实际 endpoint,不能从 API 文档推断所有入口。

知识截止也不等于实时知识。任务涉及当日价格、政策、新闻或软件版本时,仍应提供最新资料或检索工具。

价格没变,缓存读取降到四分之一

Fable 5.1 的普通输入、输出和缓存写入价格与 Fable 5 相同。真正下降的是 cache read:它从基础输入价的 0.1 倍降到 0.025 倍,也就是每百万 token 从 $1 降到 $0.25。

这对反复读取稳定前缀的工作最有价值,例如:

  • 长会话持续复用系统指令和工具定义;
  • 编码 Agent 多轮读取仓库说明与相同文件;
  • 研究任务在多个步骤中反复引用同一批资料;
  • 文档、表格和幻灯片任务持续使用一组背景材料。

一次性请求、缓存命中很少的任务不会自动获得同样幅度的降价。Anthropic 在发布说明中估算,按 token 计费的典型 Fable 工作负载总成本约低 25%,高度依赖上下文和工具的 Agent 工作负载最高可低约 45%。这些数字来自 Anthropic 对 2026 年 8 月四周使用量的统计,取决于 cache read 占比、effort 与任务构成,不是固定折扣。

预算时应拆开记录普通输入、缓存写入、缓存读取、输出、工具费用、人工检查和返工,再计算:

单次合格结果成本 = 总模型与人工成本 ÷ 通过验收的任务数

Fable 5.1 上线路线、成本与质量指标、回退预案,以及需要立即回退的 API 错误和信号
Fable 5.1 上线路线、成本与质量指标、回退预案,以及需要立即回退的 API 错误和信号

能力提升集中在哪里

Anthropic 将 Fable 5.1 的改进集中在长时间 Agent 编码、多步研究、文档与表格处理、密集图表和 PDF 视觉理解、长上下文关联,以及浏览器和桌面操作。

发布材料还列出了 Terminal-Bench-Science 0.1、Terminal-Bench 4.0、GDPval-AA v2、OSWorld 2.0、AutomationBench 和 CursorBench 3.2.0 等结果,其中 Fable 5.1 多项高于 Fable 5。它们使用 Anthropic 指定的测试版本、执行环境、effort 和安全设置,适合说明“值得进入候选”,不能证明它一定会在你的代码库或资料上获胜。

同样重要的是行为差异:

  • 独立工具操作可能拆成多个回合,增加往返时间;
  • effort 下,长任务的用户可见进度说明可能更少;
  • low effort 更可能依靠已有知识,而不是主动搜索最新资料;
  • 小改动更容易变成整文件重写;
  • 文本可能更密,格式层级比旧模型少。

这些表现只有影响任务完成时间、token、审核成本或用户体验时才是问题,应在实际运行环境中记录。

从 Fable 5 迁移会遇到三个破坏性变化

Anthropic 的变更说明列出三个必须检查的兼容问题。

1. 不再支持强制工具调用

以下 tool_choice 会返回 HTTP 400:

json
{"type": "any"} {"type": "tool", "name": "lookup_order"}

错误信息是:

text
tool_choice: type "tool" and "any" are not supported for this model.

保留默认的 {"type":"auto"}。需要结构化结果时,使用 strict tool use 或 structured outputs;必须调用工具时,在指令中清楚说明适用条件。

2. Thinking block 只保证单向兼容

Fable 5.1 可以读取较早 Claude 模型产生的 thinking block,但较早模型不能读取 Fable 5.1 的 block。同一对话回退到旧模型时,API 可能在请求到达模型前移除这些 block;未启用相应 beta 控制时,这项转换可能不会显式报告。

3. 改写前面的历史会破坏绑定

保留后续 thinking block 时,如果修改之前的消息、systemtools 或文档 bytes,请求可能返回:

text
The block is bound to a different conversation

长会话应采用只追加设计:新指令放在后面,工具变化使用中途更新,裁剪交给服务端 context editing 或 compaction。不要删除前面临时注入的提醒,也不要悄悄重建 system 或 tools。

新能力也带有明确的 beta 条件

Fable 5.1 支持按消息调整 effort、单回合 system message,以及在工具调用之间返回可读进度更新。这些能力需要文档指定的 beta header,不应在未检查平台支持时直接写进生产请求。

它的文本输出带有 Anthropic 的统计水印;通过 Claude Files API 取得的受支持图片或视频文件可包含 C2PA Content Credentials。模型当前采用 30 天数据留存,除非 Anthropic 明确批准 zero data retention。Enterprise Frontier Safeguards 是分阶段推出的企业能力,不能把未来计划写成所有账户当前都具备的 ZDR。

拒绝请求时也要检查响应体。Fable 5.1 可能返回 HTTP 200,同时带有 stop_reason: "refusal"。HTTP 成功只证明请求到达并返回,不能证明任务完成。

Claude Fable 5.1 的迁移兼容检查清单、快速验证任务、常见错误、成本和数据处理要求
Claude Fable 5.1 的迁移兼容检查清单、快速验证任务、常见错误、成本和数据处理要求

用小范围、可回退的迁移确认价值

先选一组真实任务,每项都要有可观察的合格条件,例如测试通过、JSON Schema 有效、文档数字与来源一致,或浏览器步骤完整结束。保持输入、工具、权限、超时与停止条件一致,再比较 Fable 5 与 Fable 5.1,或与当前生产模型对照。

迁移顺序可以很简单:

  1. 在少量流量中把模型 ID 改为 claude-fable-5-1
  2. 移除强制 tool_choice,保持工具 schema 严格;
  3. 原样回传 thinking block,不修改对话前缀;
  4. 重新选择 effort,观察工具调用是否仍按预期并行;
  5. 记录 cache read、输出、工具错误、P50/P95、人工修改和返工;
  6. 保留旧配置,出现异常可以立即回退。

如果 Fable 5.1 只在少数长任务上明显提升,就只让那些任务使用它。如果缓存读取确实占账单的大头,并且合格率、延迟和人工成本都保持改善,再逐步扩大。

当问题变成“整个 Claude 家族该从哪款开始”,可以继续查看独立的 Claude Fable、Opus、Sonnet 与 Haiku 选型指南。本页只回答 Fable 5.1 本身的规格、变化与迁移。