Claude Opus 5.5는 2026년 9월 22일 출시됐습니다. Claude API에서 쓸 모델 ID는 claude-opus-5-5이고, 표준 요금은 입력 100만 토큰당 4달러, 출력 100만 토큰당 20달러입니다. 기존 Opus 5의 5달러·25달러보다 각 단가가 20% 낮습니다. 다만 기존 API 연동은 모델 ID만 바꾸면 400 오류가 날 수 있습니다. thinking과 tool_choice를 먼저 점검하세요. Anthropic 모델 사양 · 공식 이전 안내
Claude Code에서 모델을 선택하는 사람이라면 API 토큰 단가를 자신의 구독료나 남은 사용량으로 읽지 않는 것이 먼저입니다. Pro·Max 등 구독의 사용 한도와 API의 종량 과금은 서로 다른 기준입니다.
지금 사용할 수 있는 모델인가요?
Anthropic의 출시 발표와 모델 페이지는 Opus 5.5의 출시일과 Claude API 모델 ID를 명시합니다. 모델 페이지에 나온 컨텍스트 창은 최대 100만 토큰, 일반 요청의 최대 출력은 12만 8천 토큰입니다. 컨텍스트 창 크기는 매번 그만큼의 토큰을 무료로 넣을 수 있다는 뜻이 아닙니다. 실제 입력량과 출력량에 따라 요금이 계산됩니다.
Claude API를 직접 호출한다면 요청의 model 값을 claude-opus-5-5로 지정합니다. Amazon Bedrock, Google Cloud 등 다른 경로에서는 해당 플랫폼의 모델 ID 형식을 써야 합니다. 문서에 플랫폼이 나열돼 있어도 개별 계정과 지역에서 바로 선택 가능한지는 별도 확인이 필요합니다. 먼저 사용 중인 콘솔이나 모델 목록에서 접근 권한을 확인하고, 프로덕션 전환 전에 개발 환경에서 실제 요청을 시험하세요. 모델별 ID와 지원 경로 · 이전 안내
Opus 5.5 API 비용은 얼마인가요?
아래는 Claude API의 표준 미국 달러 가격이며, 모두 100만 토큰당 단가입니다. 세금, 다른 플랫폼이나 재판매 사업자의 가격, 도구 사용에 따른 별도 비용은 포함하지 않습니다. 공식 모델별 요금표 · Opus 5와 비교
| 과금 항목 | Opus 5.5 | Opus 5 | 비교할 때 볼 점 |
|---|---|---|---|
| 일반 입력 | $4 | $5 | 같은 입력 토큰 수라면 5.5가 20% 저렴 |
| 일반 출력 | $20 | $25 | 같은 출력 토큰 수라면 5.5가 20% 저렴 |
| 캐시 읽기 | $0.20 | $0.50 | 캐시 적중량과 쓰기 비용을 함께 계산해야 함 |
Opus 5.5의 캐시 쓰기 가격은 5분 캐시가 100만 토큰당 5달러, 1시간 캐시가 8달러입니다. Batch API는 입력·출력에 50% 할인이 적용됩니다. 캐시 읽기 단가만 보고 전체 요청비를 계산하면 캐시 쓰기와 일반 출력 비용을 빠뜨리게 됩니다. 공식 가격 상세
예를 들어 캐시를 쓰지 않고 한 작업에서 입력 10만 토큰과 출력 2만 토큰을 썼다면, Opus 5.5 비용은 0.1 × $4 + 0.02 × $20 = $0.80입니다. 같은 토큰 수를 Opus 5에 넣으면 0.1 × $5 + 0.02 × $25 = $1.00입니다. 이 비교에서 절감액은 20센트, 비율은 20%입니다. 두 모델이 실제로 같은 수의 토큰을 쓴다는 예시이며, 완성한 작업 하나의 보편적인 가격은 아닙니다.

Anthropic은 자체 평가에서 기본 설정의 일반적인 작업 비용이 약 40% 낮았다고 설명합니다. 이는 단가 인하에 토큰 사용량 변화가 더해진 결과로 제시된 업체 측 수치입니다. 모든 프롬프트의 청구액이 40% 내려간다는 뜻은 아닙니다. 팀 예산을 짤 때는 동일한 작업 묶음에서 입력·출력·캐시 토큰과 완료율을 함께 기록해 비교하는 편이 정확합니다. Anthropic의 비용 설명
빠른 응답이 필요해 Fast mode를 고려한다면 표준 단가를 그대로 적용해서는 안 됩니다. Anthropic이 안내하는 Fast mode 입력·출력 가격은 100만 토큰당 8달러·40달러이며, 속도 향상 수치 역시 업체가 보고한 결과입니다. 사용 가능 경로와 실제 지연시간을 해당 환경에서 확인한 뒤 선택하세요. 출시 발표
Claude Code 구독에도 위 API 가격이 적용되나요?
구독에 포함된 사용량과 Claude API의 토큰 청구액은 별개입니다. Anthropic은 Opus 5.5 출시와 함께 Pro, Max, Team 및 좌석 기반 Enterprise의 5시간 사용 한도를 늘렸다고 밝혔지만, 모든 계정에 적용되는 고정 메시지 수나 개인별 잔여량을 제시하지는 않았습니다. Claude Code에서 구독으로 이용 중이라면 현재 계정의 사용량 표시와 갱신 시각을 확인하세요. API 키로 호출하는 서비스의 비용을 추정한다면 위의 API 단가와 실제 토큰 사용량을 사용해야 합니다. Anthropic 출시 안내
구독을 올릴지, API 사용량을 따로 살지 판단하는 일이 목적이라면 Claude Code Pro·Max 사용량 한도 비교에서 세션 한도와 주간 한도를 먼저 구분할 수 있습니다. 그 한도 역시 API 호출에 무료 토큰을 제공한다는 의미로 해석하면 안 됩니다.
Opus 5에서 옮길 때 400 오류를 막으려면
기존 Messages API 요청을 이전한다면 model만 교체한 뒤 종료하지 말고 아래 항목을 확인하세요. 이 항목은 Anthropic의 Opus 5 → 5.5 이전 안내에 명시된 호환성 변경입니다. Claude Managed Agents는 해당 안내에서 모델 이름 변경 외 추가 조치가 필요 없다고 구분합니다.

- 모델 ID를 바꿉니다. Claude API에서는
claude-opus-5대신claude-opus-5-5를 사용합니다. 다른 플랫폼은 그 플랫폼의 ID를 확인합니다. - 기존
thinking지정값을 제거합니다.thinking: {"type": "disabled"}와thinking: {"type": "enabled", "budget_tokens": N}는 모두 Opus 5.5에서 400 오류를 냅니다. 사고 과정은 항상 켜져 있으며, 깊이와 비용은output_config의effort로 조절합니다. 기본 effort는 Opus 5의high와 달리medium입니다. - 도구 강제 호출을 다시 설계합니다.
tool_choice의any와 특정 도구를 강제하는tool유형도 400 오류를 냅니다. 공식 안내는auto와 strict tool use 또는 structured outputs를 대안으로 제시합니다.auto가 매번 특정 도구를 실행한다는 보장은 없으므로 기존 흐름의 성공 조건을 다시 시험해야 합니다. - computer use를 쓴다면 플랫폼을 확인합니다. Claude API와 Google Cloud에서는 예전
computer_20251124도구가 400 오류를 내며,computer_toolset_20260801로 바꾸고 도구 결과 처리 방식도 조정해야 합니다. Amazon Bedrock에서는 예전 도구가 계속 작동한다고 공식 안내가 구분합니다. 다른 플랫폼은 해당 호환성 문서를 확인하세요.
오류가 나지 않더라도 응답을 읽는 코드에는 영향이 있습니다. Opus 5.5는 도구 호출 사이의 진행 문구를 이전의 text 블록 대신 thinking 블록으로 돌려줍니다. 기본 표시 설정에서는 그 블록의 텍스트가 비어 있으므로, UI가 기존 text 블록만 화면에 보여 줬다면 진행 표시가 조용해질 수 있습니다. 진행 문구가 필요한 서비스는 공식 문서의 thinking.display 설정과 반환 블록 처리 방식을 적용하고, 도구 루프에서는 thinking 블록을 원형 그대로 다시 전달해야 합니다. 대화 도중 이전 메시지나 system, tools를 수정하는 구현도 보존된 thinking 블록의 유효성 조건을 확인해야 합니다. 응답 형식과 대화 보존 조건
전환 테스트는 기존에 정상 동작하던 요청을 한두 종류 골라 시작하면 됩니다. 일반 텍스트 요청으로 모델 접근과 과금을 확인하고, 실제 서비스가 쓰는 도구 호출·대화 이어받기·진행 표시를 각각 점검하세요. 400이 나오면 오류 본문과 전송한 필드를 대조해 위 설정부터 고치고, 정상 응답이 나온 뒤에는 작업당 토큰과 지연시간을 Opus 5의 같은 조건과 비교하세요. 이 문서의 비용 계산은 공식 단가를 이용한 예시이며, 특정 계정에 대한 유료 호출이나 독립 성능 시험 결과는 아닙니다.



