Claude Fable 5.1은 2026년 9월 1일 정식 출시됐습니다. 직접 Claude API 모델 ID는 claude-fable-5-1입니다. 1M token 컨텍스트, 최대 128K 출력, 항상 켜지는 adaptive thinking을 제공하며 복잡한 추론, 장시간 에이전트, 다단계 연구와 문서 작업을 목표로 합니다.
이번 변경은 성능 개선만이 아닙니다. 기본 입력/출력 가격은 Fable 5와 같은 100만 token당 $10/$50이지만 캐시 읽기는 $0.25로 내려갔습니다. 반면 기존의 강제 tool_choice와 thinking block 처리 방식은 HTTP 400을 만들 수 있습니다. 모델 이름만 바꾸는 것이 아니라 API 마이그레이션으로 다뤄야 합니다.
공식 사양과 실제 제공 범위
Fable 5.1 공식 모델 문서는 모든 Claude API 고객에게 제공되는 active 모델로 표시합니다. Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS도 지원 플랫폼에 포함됩니다.
| 항목 | 공개 사양 |
|---|---|
| Claude API ID | claude-fable-5-1 |
| Amazon Bedrock ID | anthropic.claude-fable-5-1 |
| Context / 최대 출력 | 1M / 128K token |
| 표준 입력 / 출력 | $10 / $50 per MTok |
| 5분 / 1시간 캐시 쓰기 | $12.50 / $20 per MTok |
| 캐시 읽기 | $0.25 per MTok |
| Thinking | Adaptive, 항상 활성화 |
기본 effort | high |
| 신뢰 가능한 지식 기준일 | 2026년 6월 |
API에서 active라는 사실은 Claude.ai, Claude Code, 국내 계정, Cursor 같은 편집기나 외부 게이트웨이에 모두 동시에 표시된다는 뜻이 아닙니다. 모델이 보이지 않으면 사용하는 제품, 요금제, 지역과 실제 endpoint를 각각 확인해야 합니다.
지식 기준일도 실시간 정보 접근을 뜻하지 않습니다. 최신 가격, 정책, 소프트웨어 버전과 뉴스가 필요하면 현재 자료나 검색 도구를 제공하세요.
비용 절감은 캐시 재사용에서 발생한다
일반 입력, 출력과 캐시 쓰기 단가는 Fable 5와 같습니다. 달라진 것은 cache read입니다. 기본 입력의 0.1배에서 0.025배로 낮아져 100만 token당 $1에서 $0.25가 됐습니다.
다음처럼 안정적인 앞부분을 여러 번 읽는 작업에서 효과가 커집니다.
- 긴 대화가 같은 system 지시와 도구 정의를 반복 사용
- 코딩 에이전트가 저장소 설명과 공통 파일을 재사용
- 다단계 연구가 같은 출처 묶음을 계속 참고
- 문서·스프레드시트·슬라이드가 공통 배경 자료를 유지
한 번에 끝나는 요청이나 캐시 적중률이 낮은 작업은 같은 비율로 저렴해지지 않습니다. Anthropic은 출시 발표에서 일반적인 token 과금 Fable 작업은 총비용이 약 25%, 도구와 긴 컨텍스트를 많이 쓰는 에이전트 작업은 최대 약 45% 낮아질 수 있다고 추정했습니다.
이 수치는 2026년 8월 4주간의 사용량을 기본 effort로 분석한 공급자 추정치입니다. 고정 할인율이 아니므로 실제 입력, 캐시 쓰기·읽기, 출력, 도구, 사람 검토와 재작업 비용을 나눠 기록해야 합니다.
개선 영역과 관찰할 동작
Anthropic은 장시간 에이전트 코딩, 연구와 검색, 문서·표·슬라이드 작업, 복잡한 PDF와 차트 이해, 전체 1M context 연결, 컴퓨터 사용을 주요 개선 영역으로 설명합니다.
Terminal-Bench-Science 0.1, Terminal-Bench 4.0, GDPval-AA v2, OSWorld 2.0, AutomationBench, CursorBench 3.2.0 결과도 공개됐습니다. 특정 테스트 버전, 실행 환경, effort와 안전 장치에서 Anthropic이 측정한 수치이므로 시험 후보에 넣는 근거일 뿐 내 코드에서의 승리를 보장하지 않습니다.
실행 중에는 다음 변화도 관찰해야 합니다.
- 독립 도구 호출이 여러 turn으로 나뉠 수 있음
- 긴 작업의 사용자용 진행 메시지가 줄어들 수 있음
loweffort에서 검색보다 기존 지식에 더 의존할 수 있음- 작은 수정도 파일 전체 다시 쓰기로 이어질 수 있음
- 문장이 더 조밀하고 시각적 구분이 적을 수 있음
왕복 지연, token, 리뷰 시간과 완료율에 미치는 영향을 실제 환경에서 확인하세요.
Fable 5에서 전환할 때 깨지는 세 부분
Fable 5.1 변경 문서는 세 가지 호환성 문제를 명시합니다.
도구 강제 호출을 지원하지 않는다
tool_choice를 any 또는 특정 tool로 지정하면 HTTP 400과 다음 오류가 반환됩니다.
texttool_choice: type "tool" and "any" are not supported for this model.
tool_choice: {"type":"auto"}를 유지하고 형식은 strict tool use 또는 structured outputs로 보장합니다. 도구가 반드시 필요하면 적용 조건을 지시문에 명확히 씁니다.
Thinking block은 한 방향으로만 호환된다
Fable 5.1은 이전 Claude 모델이 만든 thinking block을 읽지만 이전 모델은 Fable 5.1의 block을 읽지 못합니다. 진행 중인 대화를 Fable 5나 Opus로 되돌리면 API가 해당 block을 모델에 보내기 전에 제거할 수 있습니다. 관련 beta 설정이 없으면 이 변환이 명시되지 않을 수 있습니다.
이전 대화 내용을 바꾸면 binding이 깨진다
나중의 thinking block을 유지한 채 앞선 메시지, system, tools, 문서 bytes를 바꾸면 다음 400 오류가 날 수 있습니다.
textThe block is bound to a different conversation
긴 대화는 추가 전용 기록으로 설계합니다. 새 지시는 뒤에 붙이고, 도구 변경은 중간 업데이트를 사용하며, 축약은 서버 측 context editing 또는 compaction으로 처리합니다.

새 기능과 데이터 조건
Fable 5.1은 메시지 단위 effort, 한 turn만 적용되는 system message, 도구 호출 사이의 읽을 수 있는 진행 업데이트를 지원합니다. 각각 문서에 지정된 beta header와 지원 API를 확인해야 합니다.
생성 텍스트에는 Anthropic의 통계적 워터마크가 들어갑니다. Claude Files API로 받는 지원 이미지·영상 파일에는 C2PA Content Credentials가 포함될 수 있습니다.
Anthropic이 명시적으로 zero data retention을 승인하지 않으면 30일 보존이 적용됩니다. Enterprise Frontier Safeguards는 단계적으로 제공되는 기업 기능이며 모든 계정의 현재 ZDR 약속이 아닙니다.
거절은 HTTP 200과 stop_reason: "refusal"로 올 수 있습니다. 전송 성공만으로 작업 완료를 판단하면 안 됩니다.
되돌릴 수 있는 소량 전환
테스트 통과, JSON Schema 적합, 원문 수치 일치, 브라우저 절차 완료처럼 확인 가능한 조건을 가진 실제 작업을 고릅니다. 현재 모델과 Fable 5.1에 같은 입력, 도구, 권한, 시간과 중지 조건을 제공합니다.
- 소량 요청에
claude-fable-5-1적용 - 강제
tool_choice제거 - thinking block을 그대로 돌려보내고 대화 앞부분 수정 금지
effort와 도구 호출 묶음을 다시 조정- 모든 token 종류, P50/P95, 오류, 거절, fallback, 사람 수정과 재작업 기록
- 기존 설정을 즉시 복구할 수 있게 유지

합격률과 실제 청구액이 개선된 작업만 범위를 넓히세요. Fable의 위치를 Opus, Sonnet, Haiku와 함께 판단하는 별도 문제는 Claude 모델 선택 가이드에서 다룹니다.



