AIFreeAPI Logo

Claude Opus 5.5 effort 설정: 다섯 단계 중 어디서 시작할까?

A
4 min readAI 가이드

Opus 5.5의 기본 effort는 medium입니다. 일상 작업은 여기서 시작하고, 완료 기준을 놓치는 작업에만 수준을 높여 보세요. Claude Code와 API의 설정 방법, 캐시 영향, 벤치마크 수치를 실제 청구액과 구분하는 법을 다룹니다.

Claude Opus 5.5의 다섯 effort 수준과 작업별 선택을 나타낸 그림

Claude Opus 5.5의 effort는 medium에서 시작하는 편이 합리적입니다. 작업이 정해진 조건을 만족하면 그대로 두고, 빠뜨린 수정 범위나 실패한 검증이 반복되면 high를 비교해 보세요. 단순 반복 작업은 low로 내려도 완료 품질이 유지되는지 시험할 수 있습니다. xhighmax는 더 많은 추론이 필요한 긴 작업을 위한 선택지이지, 모든 요청에 켜 두는 품질 스위치는 아닙니다. 공식 노력 수준 문서는 Opus 5.5가 low·medium·high·xhigh·max를 지원하며 기본값이 medium이라고 명시합니다.

여기서 effort는 토큰 수의 확정 상한이 아니라 모델의 행동을 조절하는 신호입니다. 답변, 도구 호출, 사고에 쓰는 출력 토큰에 영향을 주므로 같은 설정이라도 과제에 따라 비용과 시간이 달라집니다. 특히 Opus 5에서 effort를 생략해 사용했다면 그때의 기본값은 high였습니다. 모델만 5.5로 바꾸고 같은 수준으로 실행한다고 가정하지 마세요. Opus 5.5의 출시·API 요금과 이전 과정은 별도 안내에 있습니다.

Claude Code에서는 /effort로 바꾼다

Claude Code 세션에서 현재 수준을 확인한 다음, 바꿀 수준을 명령으로 지정합니다.

text
/effort status /effort high

두 번째 명령은 다음 요청부터 적용됩니다. 이미 나온 답변을 더 깊게 다시 계산하지는 않으므로, 바꾸고 싶은 과제를 다시 요청해야 합니다. Anthropic의 Claude Code 비용 안내는 이 두 명령과 적용 시점을 설명합니다.

긴 대화의 중간에서 수준을 바꾸는 비용도 생각해야 합니다. Claude Code에서 effort나 thinking 설정을 변경하면 캐시된 대화가 초기화되고, 다음 요청에서 대화 내용의 캐시 쓰기 비용이 발생합니다. 따라서 작은 질문마다 lowhigh를 번갈아 누르기보다는 작업 묶음의 시작에서 수준을 정하고, 막힌 이유가 분명할 때 바꾸는 편이 낫습니다. 구독 사용자는 아래 API 정가를 자기 계정에 그대로 청구되는 금액으로 읽지 말고, 자신의 사용량 화면과 한도를 확인하세요. Claude Code 캐시 동작

Claude Code에서 현재 effort를 확인하고 다음 요청에 적용할 수준을 정하는 흐름을 나타낸 그림
Claude Code에서 현재 effort를 확인하고 다음 요청에 적용할 수준을 정하는 흐름을 나타낸 그림

Messages API에서는 output_config.effort를 보낸다

Claude API의 Messages 요청에는 최상위 output_config.effort를 넣습니다. 아래는 형태를 보여 주는 Python 예시이며, 실행하려면 Anthropic SDK와 API 접근 권한이 필요합니다.

python
import anthropic client = anthropic.Anthropic() response = client.messages.create( model="claude-opus-5-5", max_tokens=4096, messages=[{"role": "user", "content": "이 변경의 영향 범위를 검토해 주세요."}], output_config={"effort": "medium"}, )

max_tokens는 사고와 최종 답변을 합친 출력 상한입니다. 높은 effort를 시험하면서 이 값을 지나치게 작게 두면, 충분히 처리할 여지를 주지 못한 시험이 됩니다. Opus 5.5에서 적응형 사고는 끌 수 없으며 thinking: {"type": "disabled"}나 예전 방식의 enabled 토큰 예산을 보내면 HTTP 400이 발생합니다. 기존 요청을 옮기는 중이라면 thinking 필드를 먼저 살펴보세요. 공식 effort 설정 예시 · Opus 5.5 변경 사항

API에서 대화 도중 effort를 바꿀 때는 두 경로의 캐시 동작이 다릅니다. 다음 요청의 최상위 output_config.effort만 변경하면 이전 턴의 캐시 접두부가 유지되지 않습니다. 지원 모델에서 베타 헤더 mid-conversation-output-config-2026-07-01을 사용하고, 빈 content와 새 effort를 담은 전용 system 메시지를 대화에 추가하면 다음 사용자 턴부터 변경되면서 그 앞부분의 캐시 접두부를 유지할 수 있습니다. 이 메시지별 방식은 베타이며 Claude Code의 /effort에 적용되는 설명이 아닙니다. 구현 전에는 메시지별 effort 설명과 예제를 확인하세요.

다섯 단계의 차이를 어떻게 읽어야 할까?

아래 수치는 Artificial Analysis의 Intelligence Index v4.3.2가 측정한 Opus 5.5, 적응형 사고, 기본 fallback 사용 결과입니다. 점수는 열 가지 평가를 합친 지수이고, 달러 수치는 그 지수의 벤치마크 과제당 가중 평균 비용입니다. 일반 API 요청 한 건의 가격이나 Claude 구독 청구액이 아닙니다. 각 수준의 측정 페이지를 연결했습니다.

EffortAA 지수 점수지수 과제당 비용선택을 시작할 때의 기준
low42$0.55결과를 기계적으로 확인할 수 있는 단순 작업
medium51$1.34범위가 분명한 일상 코딩과 분석의 출발점
high54$1.82누락된 호출부나 복잡한 조건 때문에 medium이 실패한 작업
xhigh56$3.46긴 실행과 여러 단계의 판단이 필요한 작업
max58$5.98추가 비용을 감수할 만큼 어려운 작업의 제한적 시험

이 표에서 mediumhigh는 지수 점수 51→54, 과제당 비용 $1.34→$1.82입니다. highmax는 54→58, $1.82→$5.98입니다. 따라서 점수가 높다는 이유만으로 모든 업무의 총비용이 낮아지지는 않습니다. 반대로 더 높은 effort가 실패 후 재시도를 줄인다면 완료된 작업당 비용은 낮아질 수도 있습니다. 어느 쪽인지는 벤치마크 표가 아니라 자신의 작업 완료율과 전체 실행 비용으로 판단해야 합니다. 이 글은 유료 모델 호출을 직접 시험한 결과가 아닙니다.

완료 품질과 전체 비용을 함께 비교해 effort 수준을 정하는 그림
완료 품질과 전체 비용을 함께 비교해 effort 수준을 정하는 그림

내 작업에서는 완료율·전체 비용·시간을 함께 비교한다

수준을 고를 때는 같은 유형의 실제 과제 몇 개를 골라 medium과 후보 수준을 각각 실행해 보세요. 예를 들어 API 필드 이름을 바꾸는 작업이라면 “서버 처리, 호출 클라이언트, 회귀 테스트까지 모두 반영”을 완료 기준으로 먼저 적습니다. 그런 다음 성공 여부와 누락된 변경, 재시도 횟수, 총 소요 시간, 전체 토큰 사용량을 기록합니다. 한 번의 답변 길이나 첫 턴 비용만 보면 재작업이 빠집니다. Anthropic도 기존 Opus 5 설정을 그대로 가져오지 말고 자기 워크로드에서 effort 수준별 평가를 하도록 권합니다. Opus 5.5 effort 권장 사항

직접 API를 사용한다면 과금 항목도 나눠 읽어야 합니다. Opus 5.5의 표준 가격은 100만 토큰당 일반 입력 $4, 출력 $20, 5분 캐시 쓰기 $5, 1시간 캐시 쓰기 $8, 캐시 읽기 $0.20입니다. 한 작업의 추정 비용은 각 항목의 토큰 수에 해당 단가를 곱한 뒤 더합니다. 예를 들어 출력 토큰 × $20 / 1,000,000은 출력 부분만의 비용이며, 재시도와 캐시 쓰기까지 포함한 작업 비용은 아닙니다. 다른 제공 경로, 세금이나 별도 기능 요금은 이 계산과 다를 수 있습니다. Opus 5.5 공식 요금표

변경 기준은 결과로 정하세요. medium에서 검증을 통과하고 재시도가 적으면 유지합니다. 검증 수단이 없어서 놓치는 문제라면 먼저 테스트나 체크 절차를 마련합니다. 그래도 여러 층의 변경을 자꾸 놓친다면 high를 비교합니다. low에서도 동일하게 통과하는 규칙적인 작업이라면 그쪽이 더 경제적일 수 있습니다. xhighmax는 장시간·고난도 과제에서 추가 완료율이 실제로 비용과 시간을 정당화할 때만 남깁니다. 계정별 접근 가능 여부와 실제 사용량은 사용 중인 경로에서 확인해야 합니다.