대부분의 작업에서는 Opus 5가 더 저렴한 출발점입니다. Anthropic 직접 API의 표준 가격을 기준으로 신규 입력, 출력, 캐시 쓰기 단가가 Fable 5.1의 절반이기 때문입니다. 다만 캐시 읽기는 Fable 5.1이 100만 토큰당 $0.25로, Opus 5의 $0.50보다 절반 저렴합니다.
따라서 같은 대형 컨텍스트를 여러 차례 읽는 장시간 에이전트에서는 결과가 뒤집힐 수 있습니다. 반대로 짧은 요청, 캐시 적중률이 낮은 처리, Opus가 한 번에 통과하는 작업에서는 Fable의 높은 입출력 가격을 상쇄하기 어렵습니다.
2026년 9월 4일 기준, Anthropic도 현재 모델 안내에서 대부분의 작업은 Opus 5로 시작하라고 권합니다. Fable 5.1은 고난도 추론, 장시간 에이전트 작업, 또는 Opus 5의 effort를 높여도 평가 기준을 충족하지 못한 경우에 고려하는 모델입니다.
API 가격은 다섯 종류로 나눠 봐야 한다
Claude API 가격 문서는 신규 입력과 캐시 쓰기·읽기를 별도로 계산합니다.
| 100만 토큰당 USD | Fable 5.1 | Opus 5 | 더 낮은 쪽 |
|---|---|---|---|
| 신규 입력 | $10 | $5 | Opus 5 |
| 출력 | $50 | $25 | Opus 5 |
| 5분 캐시 쓰기 | $12.50 | $6.25 | Opus 5 |
| 1시간 캐시 쓰기 | $20 | $10 | Opus 5 |
| 캐시 읽기 | $0.25 | $0.50 | Fable 5.1 |
| Batch 입력 / 출력 | $5 / $25 | $2.50 / $12.50 | Opus 5 |
낮은 읽기 단가는 캐시가 실제로 적중할 때만 의미가 있습니다. Prompt caching 설명에 따르면 먼저 동일한 prefix를 저장해야 하며, 후속 요청에서 tools, system, messages의 앞부분이 일치하고 유효 시간이 남아 있어야 재사용됩니다. 기본 유효 시간은 5분이고, 1시간 캐시는 쓰기 비용이 더 높습니다.
Opus 5 fast mode도 표준 요금과 분리해야 합니다. 이 기능은 낮은 지연 시간을 위한 research preview로 입력 $10, 출력 $50이며, 일반 Opus 5의 $5/$25를 대체하는 가격이 아닙니다. Batch API와도 함께 쓸 수 없습니다.
캐시 손익분기점은 식으로 확인할 수 있다
각 값을 100만 토큰 단위로 두고 신규 입력을 I, 출력을 O, 5분 캐시 쓰기를 W5, 1시간 캐시 쓰기를 W1, 캐시 읽기를 C라고 하겠습니다.
Fable = 10I + 50O + 12.5W5 + 20W1 + 0.25C
Opus = 5I + 25O + 6.25W5 + 10W1 + 0.50C
두 모델이 각 종류의 토큰을 정확히 같은 양만큼 쓴다면, Fable의 순수 토큰 비용이 더 낮아지는 조건은 다음과 같습니다.
C > 20I + 100O + 25W5 + 40W1
예를 들어 신규 입력 10만 토큰, 출력 2만 토큰, 추가 캐시 쓰기 없음으로 가정하면 캐시 읽기가 400만 토큰을 넘어야 Fable이 더 저렴합니다. 150만 토큰을 읽으면 Fable 약 $2.38, Opus 약 $1.75입니다. 600만 토큰이면 Fable 약 $3.50, Opus 약 $4.00으로 역전됩니다.
처음에 캐시를 새로 쓰면 손익분기점은 더 높아집니다. 첫 턴은 Opus가 싸고, 동일한 prefix를 오래 재사용하는 후속 구간은 Fable이 싸질 수 있다는 뜻입니다. 이 식은 토큰 양이 같을 때 가격표를 검산하는 도구일 뿐입니다. 실제 모델은 출력 길이와 도구 호출, 재시도 횟수가 다를 수 있습니다.

Devin의 작업당 비용이 반대로 나온 이유
Cognition은 Devin의 Fable 5.1 보고서에서 FrontierCode 1.1 Extended를 thinking level medium으로 실행했을 때 Fable 5.1은 작업당 $2.68, Opus 5는 $3.51이었다고 밝혔습니다. 해당 환경에서 Fable은 총 토큰을 33% 적게 사용했고, 두 모델 모두 전체 토큰의 95% 이상이 캐시 읽기였습니다. 대표 작업의 캐시 읽기는 Fable 약 300만, Opus 약 450만 토큰이었습니다.
이 환경에서는 Fable에 유리한 조건 두 가지가 동시에 성립합니다. 비용의 대부분이 Fable의 더 싼 캐시 읽기에 몰렸고, 실제 사용한 토큰 수도 더 적었습니다. 신규 입력과 출력 단가가 두 배여도 작업 전체 비용은 낮아질 수 있습니다.
하지만 이는 Devin의 도구, 캐시 구성, FrontierCode 과제, medium thinking, Cognition의 통과 기준에 묶인 제공사 보고입니다. 다른 저장소나 문서 분석에서도 동일한 비용 차이가 난다는 보장은 없습니다.
Anthropic의 Fable 5.1 발표에 나온 일반 작업 약 25%, 고도의 에이전트 작업 최대 약 45% 절감도 비교 대상은 Fable 5입니다. 2026년 8월 4주간 기본 effort로 사용한 자료에 따른 추정이며, Opus 5 대비 할인율이 아닙니다.
비싼 두 모델만 비교할 필요는 없다
현재 Claude 제품군의 표준 입출력 가격과 용량은 다음과 같습니다.
| 모델 | Claude API ID | 입력 / 출력 | 컨텍스트 / 최대 출력 | 먼저 검토할 작업 |
|---|---|---|---|---|
| Haiku 4.5 | claude-haiku-4-5-20251001 | $1 / $5 | 200K / 64K | 대량 처리, 낮은 지연, 자동 검수가 쉬운 작업 |
| Sonnet 5 | claude-sonnet-5 | $2 / $10 | 1M / 128K | 일상 코드, 분석, 콘텐츠, tool use |
| Opus 5 | claude-opus-5 | $5 / $25 | 1M / 128K | 복잡한 설계, 장시간 agent, 실패 비용이 큰 변경 |
| Fable 5.1 | claude-fable-5-1 | $10 / $50 | 1M / 128K | Opus로도 검수를 통과하지 못한 난제 |
결과를 schema나 규칙으로 바로 검증할 수 있다면 Haiku와 Sonnet만 비교해도 충분할 수 있습니다. 일반적인 에이전트와 전문 작업은 Sonnet과 Opus를 먼저 봅니다. Opus와 Fable의 직접 비교는 능력 한계가 드러난 고난도 작업군으로 좁혀야 시험 비용과 판단이 명확해집니다.
통과한 작업 1건의 전체 비용을 측정한다
실제 업무에서 일반 사례, 어려운 사례, 실패 영향이 큰 사례를 작은 표본으로 고릅니다. 두 모델에 같은 입력, tools, 권한, 시간 제한, 중지 조건, 통과 기준을 줍니다. 한쪽은 잘 구성된 Claude Code, 다른 쪽은 최소 API 스크립트라면 모델이 아니라 제품 구성까지 비교한 것입니다.
각 실행에서 다음을 기록합니다.
- 신규 입력, 캐시 쓰기, 캐시 읽기, thinking, 출력 토큰;
- 첫 시도 통과, 재시도 후 통과, 최종 실패;
- 첫 통과 결과까지 걸린 시간과 P50/P95;
- timeout, refusal, 잘못된 tool call, loop, fallback;
- 확인, 검토, 수정, 컨텍스트 복구에 든 사람의 시간;
- 납품 전후 되돌림과 재작업.
최종 비교 단위는 다음과 같습니다.
통과 작업당 비용 = (토큰 + 도구 + 재시도 + 사람의 검토 + 재작업) ÷ 통과 건수
Opus가 첫 시도에 안정적으로 통과한다면 Fable의 낮은 캐시 읽기 단가만으로 두 배인 입출력 가격을 메우기 어렵습니다. 동일한 대형 컨텍스트를 계속 읽고 Fable이 턴 수나 수정을 크게 줄이는 작업이라면, 그 작업군만 Fable로 올릴 근거가 생깁니다.

운영에 넣기 전 청구 경로를 확인한다
위 계산은 Anthropic 직접 Claude API의 표준 토큰 요금에 해당합니다. Batch, Opus fast mode, US-only inference 계수, Bedrock·Google Cloud의 지역 가격, 외부 게이트웨이, Claude 구독은 각기 다른 계산을 만듭니다. 실제 사용하는 환경에서 model ID와 usage 세부 항목을 확인해야 합니다.
Fable 5.1은 adaptive thinking이 항상 켜져 있고, tool choice와 thinking blocks 호환성에도 고유한 조건이 있습니다. 트래픽을 늘리기 전에 effort, max_tokens, 캐시 적중, 도구 동작, refusal, rollback을 확인하세요. 모델 사양과 전환 주의점은 Claude Fable 5.1 개별 가이드에 정리했습니다.
대부분의 팀은 Opus 5부터 시작하고, 실패를 쉽게 잡을 수 있다면 Sonnet 5부터 시작해도 됩니다. Fable 5.1은 실제 작업에서 능력 차이나 통과 작업당 비용의 역전이 확인된 범위에만 적용하는 편이 안전합니다.



