# Opus 5.5 vs Fable 5.1: Claude API 모델을 비용과 성능으로 고르는 법

> Claude Opus 5.5와 Fable 5.1의 직접 API 요금, 캐시 비용, effort 설정을 비교합니다. Haiku·Sonnet까지 포함해 작업별 출발 모델과 상향 기준을 정해 보세요.

- Source: https://www.aifreeapi.com/ko/posts/claude-sonnet-vs-opus-vs-haiku-vs-fable
- Language: ko
- Published: 2026-08-26
- Updated: 2026-09-23
- Publisher: AI Free API (https://www.aifreeapi.com)

**Claude API로 새 작업을 시작한다면 Opus 5.5를 먼저 시험하고, `effort`를 높여도 어려운 과제의 통과 기준을 못 채울 때 Fable 5.1을 비교하세요.** 반복 작업이나 검수가 쉬운 작업이라면 Sonnet 5와 Haiku 4.5에서 시작하는 편이 비용을 아낄 수 있습니다. 이는 [Anthropic의 모델 선택 안내](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model)를 실제 운영 판단으로 옮긴 출발점이지, 모든 업무에서 Opus가 더 좋은 결과를 낸다는 뜻은 아닙니다.

두 최상위 모델의 차이는 단가만 보면 분명합니다. 2026년 9월 23일 기준 Anthropic 직접 Claude API의 표준 요금에서는 **Opus 5.5가 신규 입력·출력·캐시 쓰기·캐시 읽기 모두 Fable 5.1보다 저렴합니다.** 이전 Opus 5와 Fable 5.1 비교에서 성립했던 ‘캐시를 많이 읽으면 Fable이 더 싸진다’는 계산은 이 조합에 적용되지 않습니다. 실제 선택은 같은 입력으로 *통과한 작업 1건*을 만드는 데 얼마가 드는지로 마무리해야 합니다.

## Opus 5.5와 Fable 5.1의 API 요금은 얼마나 다른가

[Claude API 공식 가격표](https://platform.claude.com/docs/en/about-claude/pricing)의 USD 단가입니다. **100만 토큰당 가격**이며 Claude 구독료나 한국 원화 청구액이 아닙니다.

| 사용량 항목 | Opus 5.5 | Fable 5.1 |
|---|---:|---:|
| 신규 입력 | $4 | $10 |
| 출력 | $20 | $50 |
| 5분 캐시 쓰기 | $5 | $12.50 |
| 1시간 캐시 쓰기 | $8 | $20 |
| 캐시 읽기 | $0.20 | $0.25 |

신규 입력·출력·캐시 쓰기 단가는 Opus가 Fable의 40%, 캐시 읽기는 80%입니다. 따라서 **각 항목의 토큰 사용량이 같고 다른 요금이 없다면**, 캐시 읽기 비중이 아무리 높아져도 Fable의 토큰 요금이 Opus보다 낮아지지 않습니다. 옛 글의 캐시 손익분기식은 Opus **5**의 캐시 읽기 단가 $0.50를 사용했기 때문에 Opus **5.5**에는 맞지 않습니다.

예를 들어 신규 입력 10만, 출력 2만, 캐시 읽기 20만 토큰을 쓰고 캐시 쓰기·도구 비용은 제외하면 다음과 같습니다.

| 계산 | Opus 5.5 | Fable 5.1 |
|---|---:|---:|
| 신규 입력 | 0.1 × $4 = $0.40 | 0.1 × $10 = $1.00 |
| 출력 | 0.02 × $20 = $0.40 | 0.02 × $50 = $1.00 |
| 캐시 읽기 | 0.2 × $0.20 = $0.04 | 0.2 × $0.25 = $0.05 |
| 합계 | **$0.84** | **$2.05** |

이는 **동일한 토큰 사용량을 가정한 요금표 계산**입니다. 실제 모델은 답변 길이, 도구 호출, 재시도 횟수와 캐시 적중량이 달라질 수 있습니다. 캐시를 처음 만드는 비용도 발생하므로 측정할 때 캐시 쓰기와 읽기를 따로 기록하세요.

![Opus 5.5와 Fable 5.1의 토큰 요금 항목과 계산 예시를 나란히 보여주는 비교 이미지](https://www.aifreeapi.com/posts/ko/claude-sonnet-vs-opus-vs-haiku-vs-fable/img/api-pricing-comparison.webp)

## 성능 비교에서는 기본 effort와 최고 점수를 섞지 말자

두 모델의 API ID는 각각 `claude-opus-5-5`, `claude-fable-5-1`입니다. [Opus 5.5 사양](https://platform.claude.com/docs/en/models/opus-5-5/overview)과 [Fable 5.1 사양](https://platform.claude.com/docs/en/models/fable-5-1/overview)에 따르면 둘 다 컨텍스트는 100만 토큰, 표준 최대 출력은 12만 8천 토큰입니다. API 기본 `effort`는 Opus 5.5가 `medium`, Fable 5.1이 `high`로 서로 다릅니다. 기본 설정 그대로의 비교와 동일한 `effort`에서의 비교는 서로 다른 질문에 답합니다.

Anthropic은 [Opus 5.5 발표 자료](https://www.anthropic.com/claude-opus-5-5)에서 대부분의 작업에서 Fable 5.1 수준의 성능이라고 설명하고, Terminal-Bench 4.0과 CursorBench 4.0 등의 결과를 제시합니다. 다만 게시된 Opus 수치는 주로 `max` effort이고 Terminal-Bench 수치는 `xhigh`입니다. 최고 점수를 보고 기본 `medium` 설정에서도 같은 성능이라고 기대하면 안 됩니다. Anthropic이 말한 통상적인 실행 비용 **40% 절감의 비교 대상도 Fable 5.1이 아닌 이전 Opus 5**입니다.

실무에서는 먼저 Opus 5.5의 기본 설정을 시험합니다. 해결률이 부족하면 동일한 평가 세트로 effort를 올려 보고, 그래도 어려운 추론이나 긴 에이전트 작업에서 요구 수준을 못 채우면 Fable 5.1을 비교합니다. effort가 높아질수록 결과와 토큰 사용량이 함께 달라질 수 있으므로 설정값을 기록해야 비교가 됩니다.

## Haiku·Sonnet·Opus·Fable 중 어디서 시작할까

최상위 두 모델만 대조하면 더 싼 선택지를 놓치기 쉽습니다. [공식 가격표](https://platform.claude.com/docs/en/about-claude/pricing)와 [모델 선택 안내](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model)를 기준으로 네 모델의 출발점을 나누면 다음과 같습니다. 입력·출력 요금은 직접 API의 **100만 토큰당 USD 표준 가격**입니다.

| 모델과 API ID | 입력 / 출력 | 먼저 시험할 작업 | 다음 모델로 옮길 신호 |
|---|---:|---|---|
| Haiku 4.5 `claude-haiku-4-5-20251001` | $1 / $5 | 대량 분류·추출처럼 결과를 쉽게 검증할 수 있는 작업 | 검수 부담이나 실패율이 커질 때 Sonnet |
| Sonnet 5 `claude-sonnet-5` | $2 / $10 | 일상적인 코드 작성·분석·도구 사용 | 복잡한 과제에서 수정과 재시도가 잦을 때 Opus |
| Opus 5.5 `claude-opus-5-5` | $4 / $20 | 어려운 코드·설계·긴 에이전트 작업 | effort를 높여도 통과 기준을 못 채울 때 Fable |
| Fable 5.1 `claude-fable-5-1` | $10 / $50 | Opus에서 남은 고난도 작업군 | 실측 개선이 비용 증가를 메우지 못하면 Opus로 환원 |

낮은 단가가 곧 낮은 업무 비용은 아닙니다. 예컨대 Sonnet으로 끝나는 작업을 Opus에 전부 보낼 이유는 적지만, Sonnet의 재시도와 사람의 수정이 잦은 작업은 Opus가 더 경제적일 수 있습니다. 마찬가지로 Fable이 훨씬 비싼 토큰을 쓰더라도 특정 과제를 더 적은 실행과 수정으로 통과한다면 그 작업군에서는 가치가 생깁니다. 이 결론은 가격표만으로 낼 수 없습니다.

## 통과한 작업당 비용을 어떻게 비교할까

일반 사례와 어려운 사례를 섞어 실제 업무의 작은 평가 세트를 만드세요. 두 모델에 같은 입력·도구·권한·시간 제한·중지 조건·통과 기준을 줍니다. API 호출과 Claude Code 같은 완성된 제품을 서로 맞붙이면 모델 차이와 제품 차이가 뒤섞입니다.

각 실행에서는 신규 입력, 캐시 쓰기, 캐시 읽기, 출력 토큰과 `effort`를 함께 기록합니다. 첫 시도 통과 여부, 재시도 횟수, 도구 오류, 소요 시간, 사람의 검토·수정 시간도 남깁니다. 성공을 뒤늦게 골라내지 말고 실패 실행의 비용까지 포함해야 합니다.

`통과한 작업당 비용 = (첫 시도와 재시도의 토큰·도구 요금 + 사람의 검토·수정 비용) ÷ 통과 건수`

우선 Opus 5.5와 Fable 5.1을 **같은 평가 조건**에서 비교하고, 기본 설정으로 사용할 계획이라면 기본 설정끼리 별도로 비교하세요. Fable이 더 높은 통과율이나 더 짧은 수정 시간으로 추가 요금을 상쇄하는 작업 유형만 Fable로 분기하면 됩니다. 이 글의 $0.84/$2.05 계산은 실측 비용이 아니라 평가 전에 세울 수 있는 동일 토큰 기준선입니다.

![같은 조건에서 여러 Claude 모델을 평가하고 통과율과 작업 비용을 기록해 모델을 선택하는 흐름도](https://www.aifreeapi.com/posts/ko/claude-sonnet-vs-opus-vs-haiku-vs-fable/img/accepted-task-evaluation.webp)

## 배포 전 확인할 경로와 설정

위 단가는 Anthropic 직접 Claude API의 표준 요금입니다. Batch, Fast 모드, 데이터 처리 지역 설정, Bedrock·Google Cloud 같은 파트너 경로, 외부 게이트웨이와 Claude 구독은 요금이나 이용 조건이 다릅니다. 예를 들어 [공식 가격표](https://platform.claude.com/docs/en/about-claude/pricing)의 Opus 5.5 Fast 요금은 입력 $8·출력 $40으로 표준 $4·$20과 구분됩니다. 실제 청구 경로의 가격과 usage 내역을 먼저 확인하세요.

기존 모델에서 옮긴다면 비용 외에 API 동작도 확인해야 합니다. [Opus 5.5 변경 안내](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5)에는 thinking과 강제 도구 선택 등 요청 형식에 영향을 주는 내용이 있습니다. 작은 트래픽에서 `effort`, `max_tokens`, 캐시 적중, 도구 호출과 중단·복구 동작을 살핀 뒤 범위를 넓히세요. 모델 자체의 세부사항은 [Opus 5.5 안내](/ko/posts/claude-opus-5-5)와 [Fable 5.1 안내](/ko/posts/claude-fable-5-1)에서 이어서 볼 수 있습니다.
