標準のClaude API料金だけを見るなら、まずOpus 5を選ぶのが合理的です。新規入力、出力、キャッシュ書き込みは、いずれもFable 5.1の半額です。ただし、キャッシュ読み取りだけは逆で、Fable 5.1が100万トークン当たり$0.25、Opus 5が$0.50です。
この差により、同じ大きなコンテキストを何度も読む長時間エージェントでは、Fable 5.1のほうが1タスク当たりで安くなる場合があります。一方、単発の質問、キャッシュヒットが少ない処理、Opusが一度で合格する仕事では、Fableの高い入出力料金を取り戻しにくいでしょう。
2026年9月4日時点で、Anthropicのモデル一覧も、多くの用途ではOpus 5から始めるよう案内しています。Fable 5.1は、高度な推論や長時間のエージェント処理、またはOpus 5のeffortを上げても評価基準を満たさない仕事に向けた選択肢です。
料金表は5種類のトークンに分けて読む
Claude APIの料金表では、新規入力とキャッシュの書き込み・読み取りが別々に計上されます。
| 100万トークン当たり、USD | Fable 5.1 | Opus 5 | 安いモデル |
|---|---|---|---|
| 新規入力 | $10 | $5 | Opus 5 |
| 出力 | $50 | $25 | Opus 5 |
| 5分キャッシュ書き込み | $12.50 | $6.25 | Opus 5 |
| 1時間キャッシュ書き込み | $20 | $10 | Opus 5 |
| キャッシュ読み取り | $0.25 | $0.50 | Fable 5.1 |
| Batch入力 / 出力 | $5 / $25 | $2.50 / $12.50 | Opus 5 |
キャッシュ読み取りの安さは、最初のリクエストにはそのまま適用されません。Prompt cachingの説明によると、まず同一のprefixをキャッシュに書き込み、保存期間中の後続リクエストで一致した部分を再利用します。既定の保存期間は5分で、1時間キャッシュは書き込み料金が高くなります。tools、system、過去のmessagesが変われば、想定したヒット率にならないこともあります。
Opus 5のfast modeも分けて考えます。これは低遅延のためのresearch previewで、入力$10・出力$50です。通常のOpus 5の$5/$25を置き換える標準料金ではなく、Batchとも併用できません。
同じトークン量なら損益分岐点を計算できる
各値を「100万トークン単位」とし、新規入力をI、出力をO、5分キャッシュ書き込みをW5、1時間書き込みをW1、キャッシュ読み取りをCとします。
Fable = 10I + 50O + 12.5W5 + 20W1 + 0.25C
Opus = 5I + 25O + 6.25W5 + 10W1 + 0.50C
両モデルで各種トークン量が同じなら、Fableが安くなる条件は次の通りです。
C > 20I + 100O + 25W5 + 40W1
たとえば、新規入力10万トークン、出力2万トークン、追加のキャッシュ書き込みなしというタスクでは、キャッシュ読み取りが400万トークンを超えて初めてFableが有利になります。読み取り150万なら、Fableは約$2.38、Opusは約$1.75です。600万なら、Fableは約$3.50、Opusは約$4.00となり、結果が逆転します。
キャッシュを書き込む初回は、さらに高い再利用量が必要です。そのため、最初のターンではOpus、その後に同じprefixを長く再利用する区間ではFableが有利になることもあります。この式が示すのは、あくまで同じトークン量に対する請求額です。モデルごとに出力量やツール呼び出し回数が違えば、実測値を使い直す必要があります。

Devinの$2.68対$3.51は特殊条件で説明できる
CognitionはDevinでのFable 5.1の報告で、FrontierCode 1.1 Extendedをthinking level mediumで実行した際、平均タスクコストがFable 5.1は$2.68、Opus 5は$3.51だったとしています。同社の集計ではFableが使った総トークンは33%少なく、両モデルとも95%以上がキャッシュ読み取りでした。代表的なタスクでは、Fableが約300万、Opusが約450万のキャッシュトークンを読み取ったと報告されています。
この環境では、Fableに有利な条件が二つ重なります。請求の大半がFableの安いキャッシュ読み取りであり、実際のトークン量もFableのほうが少ないためです。入力・出力の単価がOpusの2倍でも、タスク全体では逆転できます。
ただし、これはDevinのツール構成、キャッシュ配置、FrontierCodeの課題、medium thinking、Cognitionの合格判定に依存する提供元の結果です。別のコードベース、文書処理、サポート業務でも同じ割合になるとは限りません。
AnthropicがFable 5.1の発表で示した「一般的な処理で約25%、高度なエージェント処理で最大約45%」という削減率も、比較対象はFable 5です。2026年8月の4週間、既定effortでの利用データに基づく推定であり、Opus 5より一律に安いという意味ではありません。
4モデルを総当たりにしない
現行のClaudeには、より安い候補もあります。
| モデル | API ID | 標準入力 / 出力 | Context / 最大出力 | 最初に検討しやすい仕事 |
|---|---|---|---|---|
| Haiku 4.5 | claude-haiku-4-5-20251001 | $1 / $5 | 200K / 64K | 大量処理、低遅延、自動判定しやすい処理 |
| Sonnet 5 | claude-sonnet-5 | $2 / $10 | 1M / 128K | 日常のコード、分析、コンテンツ、tool use |
| Opus 5 | claude-opus-5 | $5 / $25 | 1M / 128K | 複雑な設計、長いagent、高い失敗コスト |
| Fable 5.1 | claude-fable-5-1 | $10 / $50 | 1M / 128K | Opusでも評価基準を満たさない難所 |
スキーマで自動検証できる大量処理なら、HaikuとSonnetの比較で十分かもしれません。通常のエージェントや専門作業なら、SonnetとOpusを比べます。OpusとFableを直接比べるのは、長時間・高難度の部分に絞るほうが、評価費用も結論も管理しやすくなります。
合格したタスクの総コストを残す
実業務から、通常例、難しい例、失敗時の影響が大きい例を少数選びます。両モデルには同じ入力、tools、権限、時間制限、停止条件、合格判定を与えます。Claude Codeの完成した環境と最小構成のAPIスクリプトを比べる場合は、純粋なモデル比較ではなく、製品構成の比較として扱います。
各実行で残す項目は次の通りです。
- 新規入力、キャッシュ書き込み、キャッシュ読み取り、thinking、出力の各トークン;
- 初回合格、再試行後の合格、最終不合格;
- 最初の合格結果までの時間、P50とP95;
- timeout、refusal、誤ったtool call、loop、fallback;
- 確認、レビュー、修正、コンテキスト復旧に使った人の時間;
- 納品前後に戻した変更や再作業。
最終的には、次の単位で比べます。
合格タスク単価 =(トークン + ツール + 再試行 + 人の確認 + 手戻り)÷ 合格件数
Opusが安定して一度で合格するなら、Fableのキャッシュ単価だけで差を埋めるのは困難です。反対に、同じ大規模コンテキストを何度も読み、Fableがターン数や修正を大きく減らすなら、その部分だけをFableへ上げる判断ができます。

本番前に課金経路と互換性を確認する
ここまでの計算は、標準のAnthropic直接APIを前提にしています。Batch、Opus fast mode、US-only inferenceの係数、BedrockやGoogle Cloudの地域料金、外部ゲートウェイ、Claudeのサブスクリプションでは請求方法が変わります。実際に利用する環境でmodel IDとusage内訳を確認してください。
Fable 5.1はadaptive thinkingが常時有効で、tool choiceやthinking blocksの互換性にも固有の条件があります。切り替え前にeffort、max_tokens、キャッシュヒット、tool、refusal、rollbackを確認します。仕様と移行手順の詳細はClaude Fable 5.1の個別ガイドにまとめています。
最初の候補は、多くの場合Opus 5です。失敗を安く検出できるならSonnet 5から始めてもよいでしょう。Fable 5.1を使うのは、実際のタスクで能力差または合格タスク単価の逆転を確認できた範囲に限定するのが安全です。



