AIFreeAPI Logo

Claude Opus 5.5 已发布:API 价格、能力与从 Opus 5 迁移的检查项

A
10 分钟阅读AI模型

Opus 5.5 已正式发布,Claude API 模型 ID 为 claude-opus-5-5。标准输入、输出分别为每百万 Token 4 美元、20 美元;但旧项目不能只改模型名就默认兼容。本文用同等用量算清费用,并列出切换前要检查的参数和工具链。

开发者审视 Claude Opus 5.5 的 API 费用、编程能力与迁移兼容性

Claude Opus 5.5 已正式发布。 Anthropic 于 2026 年 9 月 22 日推出该模型,Claude API 的模型 ID 是 claude-opus-5-5。如果你准备从 Opus 5 切换,先按自己的输入、输出和缓存用量重算费用,再检查 thinking、工具选择和 computer use 等兼容项;直接替换模型 ID 只适用于未触及这些变化的调用。发布公告模型规格分别给出了发布时间、标价和能力边界。

Opus 5.5 到底更新了什么

这次发布面向长时间运行的编程代理和知识工作。官方规格列出 100 万 Token 上下文窗口、常规请求最多 12.8 万 Token 输出,以及始终开启的 adaptive thinking;未显式设置时,effort 默认为 medium。Batch API 的 30 万 Token 最大输出属于需要指定 beta header 的单独能力,不能当作普通请求的输出上限。模型规格

Anthropic 报告,Opus 5.5 在其 Terminal-Bench 4.0 设置下得分 66.4%,Opus 5 为 52.3%;普通输出速度在其测试中提高超过 30%。这些是厂商公布的结果,基准的 effort、代理框架及安全回退条件会影响对比,不能据此推断你的仓库任务也能获得同样幅度的提速或成功率。迁移决策仍应以你自己的代表性任务、完成质量、耗时和账单为准。官方测试说明

对 Claude Code 用户,最直接的变化是可以使用新模型完成较长的代码任务。Anthropic 同时宣布提高 Pro、Max、Team 及按席位计费的 Enterprise 套餐的五小时使用限额,并提供可自行选择时间使用的一次限额重置;公告没有给每位用户通用的固定消息数。订阅额度与 Claude API 的按量计费是两套规则,不要拿 API 单价推算 Claude Code 套餐能发多少次请求。发布公告

官方 API 价格:降的是哪些费用

下表是 Anthropic Claude API 标准模式的美元标价,单位统一为每百万 Token,不是每次请求的固定费用,也不代表云平台或转售商的最终报价。Opus 5 的比较数字来自同一份官方价格对照;Opus 5.5 的缓存写入档位见模型规格

Opus 5.5 与 Opus 5 在相同 Token 用量下的费用比较,以及典型任务成本的不同口径
Opus 5.5 与 Opus 5 在相同 Token 用量下的费用比较,以及典型任务成本的不同口径
计费项目Opus 5.5Opus 5如何理解
普通输入$4$5同等输入 Token,单价低 20%
普通输出$20$25同等输出 Token,单价低 20%
缓存读取$0.20$0.50同等缓存读取 Token,单价低 60%
五分钟缓存写入$5$6.25写入和读取是不同计费项目

例如,一次任务若恰好使用 10 万普通输入 Token 和 2 万输出 Token,且没有缓存、工具等额外费用,Opus 5.5 为 0.1 × $4 + 0.02 × $20 = $0.80;Opus 5 为 0.1 × $5 + 0.02 × $25 = $1.00。相同 Token 用量下降 20%,并非 40%。若只看 20 万缓存读取 Token,费用分别是 $0.04 和 $0.10。实际账单还可能包含缓存写入、不同用量、税费及所选平台的其他费用。

Anthropic 所说的“典型任务运行成本下降 40%”,来自其默认设置下单价变化与每个任务消耗的 Token 变化共同作用。这是一组官方工作负载的结果,并不是给每位用户的统一折扣。比较旧版和新版时,最好按“同一批任务的完成数量、质量、输入/输出/缓存 Token 及总费用”计算每个成功任务的成本,而非只比单次请求价格。官方成本说明

如要缩短等待时间,还要区分 Fast mode:Anthropic 为 Opus 5.5 单独标出最高 2.5 倍速度,输入和输出分别为每百万 Token $8 和 $40;这不是上表的标准模式价格。Claude Platform 上的 Fast mode 属于 research preview,是否能使用取决于具体入口。发布公告模型页面可用于核对当前状态。

从 Opus 5 换模型 ID,哪些代码会出问题

一个只传普通消息、由模型自行选择工具、按内容块类型处理返回值的简单调用,通常可以先把 model 改为 claude-opus-5-5 再验证。但对现有代理或 Claude Code 周边工具,改 ID 只是迁移的第一步Anthropic 的迁移指南列出以下需要逐项检查的变化:

从 Opus 5 切换至 Opus 5.5 前检查思考配置、工具调用、computer use 和进度显示
从 Opus 5 切换至 Opus 5.5 前检查思考配置、工具调用、computer use 和进度显示
  1. 删除手动开关 thinking 的旧配置。 Opus 5.5 的 adaptive thinking 始终开启;旧的 thinking: {"type": "disabled"} 或显式 enabled 写法需要移除,改用 effort 控制深度。旧项目若省略 effort,要留意新版默认是 medium,与 Opus 5 默认 high 不同。先按任务质量和延迟重新选档。
  2. 检查强制工具调用。 tool_choice 指定 any 或某个 tool 会返回 400 错误,计数接口也受影响。需要工具输入符合 schema 时,官方建议改用 auto 搭配 strict tool use 或 structured outputs,并在提示中说明何时用工具。不要把这种改变误认为“工具能力消失”。
  3. 检查跨模型回退和历史消息。 Opus 5.5 的 thinking block 与模型、对话历史相关;路由器切到另一模型时,对方未必能读取这些块。若在对话中途改写 system、tools 或先前消息,再回传已有 thinking block,也可能触发 400。保持对话追加式,并在回传工具结果时保留原内容块。
  4. 使用 computer use 的项目看平台。 在 Claude API 和 Google Cloud 上,旧 computer_20251124 工具类型会报 400,须迁到 computer_toolset_20260801,同时调整代理循环对工具动作和结果的处理;Amazon Bedrock 的旧工具仍可继续使用。先确认你实际使用的平台,不要把一条平台的迁移步骤套到所有入口。
  5. 检查工具调用之间的进度显示。 Opus 5.5 将这类文字放入 thinking 内容块,默认 display 设置下文字为空。如果界面原先只渲染 text 块,用户会看到进度提示消失,但请求本身未必失败。需要保留进度时,按官方指南设置可返回更新的 display 值,并按内容块类型渲染。

切换时建议在开发环境挑一组真实任务做回归:先确认请求没有 400,再核对工具执行、对话续接、用户可见进度和最终结果;最后比较所选 effort 下的成功任务成本与耗时。这比只发一个“你好”请求更能暴露迁移问题。具体参数及平台例外以官方迁移指南为准。

该选 Opus 5.5、保留 Opus 5,还是看别的入口

如果你已经在用 Opus 5 做长代码任务,且可以改动代理配置,Opus 5.5 值得优先进入小流量评估:官方标准输入/输出单价更低,缓存读取降幅更大,但能否节省每个完成任务的成本,仍要看你的任务分布与质量要求。若现有流程依赖强制工具、关闭 thinking 或旧 computer use,就先修兼容性,再迁生产流量。模型规格迁移指南分别对应这两个判断。

如果关注的是 Claude Code 套餐,先在自己的账户中确认模型入口与使用限额;如果用 API,则先确认账户、平台、地区及计费页面是否实际开放,再按该入口的价格结算。官方列出 Claude API、Amazon Bedrock、Google Cloud 等路线,但列出平台不等于每个中国地区账户都已获得权限。第三方服务的报价、稳定性与可用性也不能从 Anthropic 的美元标价直接推出。官方可用平台列表

还在比较更高价模型的读者,可以另看本站的Claude Fable 5.1 介绍;那是不同模型的选择问题。对当前这次升级,先拿你的真实任务建立 Opus 5 基线,再用 Opus 5.5 的相同任务、明确的 effort 和相同计费口径复测,就能判断这次切换是否值得。