AIFreeAPI Logo

Fable 5.1 vs Opus 5 비용 비교: 캐시가 역전시키는 조건

A
5 min readAI 모델 비교

Opus 5는 신규 입력·출력·캐시 쓰기가 절반 가격이고, Fable 5.1은 캐시 읽기가 절반 가격입니다. 캐시 재사용량과 실제 통과율이 최종 비용을 정합니다.

Fable 5.1과 Opus 5 비용을 표준 토큰 가격, 캐시 역전 조건, 실제 작업당 비용과 Claude 모델군으로 비교한 안내도

대부분의 작업에서는 Opus 5가 더 저렴한 출발점입니다. Anthropic 직접 API의 표준 가격을 기준으로 신규 입력, 출력, 캐시 쓰기 단가가 Fable 5.1의 절반이기 때문입니다. 다만 캐시 읽기는 Fable 5.1이 100만 토큰당 $0.25로, Opus 5의 $0.50보다 절반 저렴합니다.

따라서 같은 대형 컨텍스트를 여러 차례 읽는 장시간 에이전트에서는 결과가 뒤집힐 수 있습니다. 반대로 짧은 요청, 캐시 적중률이 낮은 처리, Opus가 한 번에 통과하는 작업에서는 Fable의 높은 입출력 가격을 상쇄하기 어렵습니다.

2026년 9월 4일 기준, Anthropic도 현재 모델 안내에서 대부분의 작업은 Opus 5로 시작하라고 권합니다. Fable 5.1은 고난도 추론, 장시간 에이전트 작업, 또는 Opus 5의 effort를 높여도 평가 기준을 충족하지 못한 경우에 고려하는 모델입니다.

API 가격은 다섯 종류로 나눠 봐야 한다

Claude API 가격 문서는 신규 입력과 캐시 쓰기·읽기를 별도로 계산합니다.

100만 토큰당 USDFable 5.1Opus 5더 낮은 쪽
신규 입력$10$5Opus 5
출력$50$25Opus 5
5분 캐시 쓰기$12.50$6.25Opus 5
1시간 캐시 쓰기$20$10Opus 5
캐시 읽기$0.25$0.50Fable 5.1
Batch 입력 / 출력$5 / $25$2.50 / $12.50Opus 5

낮은 읽기 단가는 캐시가 실제로 적중할 때만 의미가 있습니다. Prompt caching 설명에 따르면 먼저 동일한 prefix를 저장해야 하며, 후속 요청에서 tools, system, messages의 앞부분이 일치하고 유효 시간이 남아 있어야 재사용됩니다. 기본 유효 시간은 5분이고, 1시간 캐시는 쓰기 비용이 더 높습니다.

Opus 5 fast mode도 표준 요금과 분리해야 합니다. 이 기능은 낮은 지연 시간을 위한 research preview로 입력 $10, 출력 $50이며, 일반 Opus 5의 $5/$25를 대체하는 가격이 아닙니다. Batch API와도 함께 쓸 수 없습니다.

캐시 손익분기점은 식으로 확인할 수 있다

각 값을 100만 토큰 단위로 두고 신규 입력을 I, 출력을 O, 5분 캐시 쓰기를 W5, 1시간 캐시 쓰기를 W1, 캐시 읽기를 C라고 하겠습니다.

Fable = 10I + 50O + 12.5W5 + 20W1 + 0.25C

Opus = 5I + 25O + 6.25W5 + 10W1 + 0.50C

두 모델이 각 종류의 토큰을 정확히 같은 양만큼 쓴다면, Fable의 순수 토큰 비용이 더 낮아지는 조건은 다음과 같습니다.

C > 20I + 100O + 25W5 + 40W1

예를 들어 신규 입력 10만 토큰, 출력 2만 토큰, 추가 캐시 쓰기 없음으로 가정하면 캐시 읽기가 400만 토큰을 넘어야 Fable이 더 저렴합니다. 150만 토큰을 읽으면 Fable 약 $2.38, Opus 약 $1.75입니다. 600만 토큰이면 Fable 약 $3.50, Opus 약 $4.00으로 역전됩니다.

처음에 캐시를 새로 쓰면 손익분기점은 더 높아집니다. 첫 턴은 Opus가 싸고, 동일한 prefix를 오래 재사용하는 후속 구간은 Fable이 싸질 수 있다는 뜻입니다. 이 식은 토큰 양이 같을 때 가격표를 검산하는 도구일 뿐입니다. 실제 모델은 출력 길이와 도구 호출, 재시도 횟수가 다를 수 있습니다.

Fable 5.1과 Opus 5의 표준 요금, 캐시 손익분기식, Devin 토큰 구성, 현재 Claude 모델군과 통과 작업당 비용 측정표
Fable 5.1과 Opus 5의 표준 요금, 캐시 손익분기식, Devin 토큰 구성, 현재 Claude 모델군과 통과 작업당 비용 측정표

Devin의 작업당 비용이 반대로 나온 이유

Cognition은 Devin의 Fable 5.1 보고서에서 FrontierCode 1.1 Extended를 thinking level medium으로 실행했을 때 Fable 5.1은 작업당 $2.68, Opus 5는 $3.51이었다고 밝혔습니다. 해당 환경에서 Fable은 총 토큰을 33% 적게 사용했고, 두 모델 모두 전체 토큰의 95% 이상이 캐시 읽기였습니다. 대표 작업의 캐시 읽기는 Fable 약 300만, Opus 약 450만 토큰이었습니다.

이 환경에서는 Fable에 유리한 조건 두 가지가 동시에 성립합니다. 비용의 대부분이 Fable의 더 싼 캐시 읽기에 몰렸고, 실제 사용한 토큰 수도 더 적었습니다. 신규 입력과 출력 단가가 두 배여도 작업 전체 비용은 낮아질 수 있습니다.

하지만 이는 Devin의 도구, 캐시 구성, FrontierCode 과제, medium thinking, Cognition의 통과 기준에 묶인 제공사 보고입니다. 다른 저장소나 문서 분석에서도 동일한 비용 차이가 난다는 보장은 없습니다.

Anthropic의 Fable 5.1 발표에 나온 일반 작업 약 25%, 고도의 에이전트 작업 최대 약 45% 절감도 비교 대상은 Fable 5입니다. 2026년 8월 4주간 기본 effort로 사용한 자료에 따른 추정이며, Opus 5 대비 할인율이 아닙니다.

비싼 두 모델만 비교할 필요는 없다

현재 Claude 제품군의 표준 입출력 가격과 용량은 다음과 같습니다.

모델Claude API ID입력 / 출력컨텍스트 / 최대 출력먼저 검토할 작업
Haiku 4.5claude-haiku-4-5-20251001$1 / $5200K / 64K대량 처리, 낮은 지연, 자동 검수가 쉬운 작업
Sonnet 5claude-sonnet-5$2 / $101M / 128K일상 코드, 분석, 콘텐츠, tool use
Opus 5claude-opus-5$5 / $251M / 128K복잡한 설계, 장시간 agent, 실패 비용이 큰 변경
Fable 5.1claude-fable-5-1$10 / $501M / 128KOpus로도 검수를 통과하지 못한 난제

결과를 schema나 규칙으로 바로 검증할 수 있다면 Haiku와 Sonnet만 비교해도 충분할 수 있습니다. 일반적인 에이전트와 전문 작업은 Sonnet과 Opus를 먼저 봅니다. Opus와 Fable의 직접 비교는 능력 한계가 드러난 고난도 작업군으로 좁혀야 시험 비용과 판단이 명확해집니다.

통과한 작업 1건의 전체 비용을 측정한다

실제 업무에서 일반 사례, 어려운 사례, 실패 영향이 큰 사례를 작은 표본으로 고릅니다. 두 모델에 같은 입력, tools, 권한, 시간 제한, 중지 조건, 통과 기준을 줍니다. 한쪽은 잘 구성된 Claude Code, 다른 쪽은 최소 API 스크립트라면 모델이 아니라 제품 구성까지 비교한 것입니다.

각 실행에서 다음을 기록합니다.

  • 신규 입력, 캐시 쓰기, 캐시 읽기, thinking, 출력 토큰;
  • 첫 시도 통과, 재시도 후 통과, 최종 실패;
  • 첫 통과 결과까지 걸린 시간과 P50/P95;
  • timeout, refusal, 잘못된 tool call, loop, fallback;
  • 확인, 검토, 수정, 컨텍스트 복구에 든 사람의 시간;
  • 납품 전후 되돌림과 재작업.

최종 비교 단위는 다음과 같습니다.

통과 작업당 비용 = (토큰 + 도구 + 재시도 + 사람의 검토 + 재작업) ÷ 통과 건수

Opus가 첫 시도에 안정적으로 통과한다면 Fable의 낮은 캐시 읽기 단가만으로 두 배인 입출력 가격을 메우기 어렵습니다. 동일한 대형 컨텍스트를 계속 읽고 Fable이 턴 수나 수정을 크게 줄이는 작업이라면, 그 작업군만 Fable로 올릴 근거가 생깁니다.

Fable 5.1과 Opus 5 비용 판단 요약으로 토큰별 가격, 캐시 역전선, Devin 사례와 동일 조건 시험 절차를 보여 주는 표
Fable 5.1과 Opus 5 비용 판단 요약으로 토큰별 가격, 캐시 역전선, Devin 사례와 동일 조건 시험 절차를 보여 주는 표

운영에 넣기 전 청구 경로를 확인한다

위 계산은 Anthropic 직접 Claude API의 표준 토큰 요금에 해당합니다. Batch, Opus fast mode, US-only inference 계수, Bedrock·Google Cloud의 지역 가격, 외부 게이트웨이, Claude 구독은 각기 다른 계산을 만듭니다. 실제 사용하는 환경에서 model ID와 usage 세부 항목을 확인해야 합니다.

Fable 5.1은 adaptive thinking이 항상 켜져 있고, tool choice와 thinking blocks 호환성에도 고유한 조건이 있습니다. 트래픽을 늘리기 전에 effort, max_tokens, 캐시 적중, 도구 동작, refusal, rollback을 확인하세요. 모델 사양과 전환 주의점은 Claude Fable 5.1 개별 가이드에 정리했습니다.

대부분의 팀은 Opus 5부터 시작하고, 실패를 쉽게 잡을 수 있다면 Sonnet 5부터 시작해도 됩니다. Fable 5.1은 실제 작업에서 능력 차이나 통과 작업당 비용의 역전이 확인된 범위에만 적용하는 편이 안전합니다.