Gemini API의 Free, Tier 1, Tier 2, Tier 3는 모든 모델에 공통으로 적용되는 고정 RPM 표가 아닙니다. 실제 요청 한도는 모델, 프로젝트, 연결된 결제 계정, 계정 상태, 일반·Priority·Batch 요청 방식에 따라 달라집니다. Google은 현재 적용 한도를 Google AI Studio에서 확인하도록 안내합니다.
429 RESOURCE_EXHAUSTED가 발생하면 “Tier 1인데 왜 300 RPM도 안 되지?”부터 묻기보다, 실패한 요청이 어느 프로젝트와 모델을 사용했는지, 어떤 사용 등급을 상속했는지, RPM·입력 TPM·RPD·모델별 한도·지출 한도 중 무엇에 닿았는지 확인해야 합니다.
한도 확인 화면을 프로젝트와 맞추세요
Google의 Gemini API 요청 한도 문서는 사용 등급을 비롯한 여러 조건에 따라 한도가 달라진다고 설명합니다. 또한 공개된 한도가 보장되는 값은 아니며 실제 용량이 달라질 수 있다고 명시합니다.
AI Studio에서는 같은 대상을 비교해야 합니다.
- Projects 또는 API keys에서 키가 속한 프로젝트와 연결된 결제 계정, 현재 사용 등급을 확인합니다.
- Dashboard의 Rate Limit에서 실제 호출한 모델을 선택하고 현재 RPM, 입력 TPM, RPD 또는 모델별 한도를 봅니다.
- Usage에서 같은 프로젝트와 시간대의 사용량을 확인합니다.
- 요청이 일반 트래픽, Priority inference, Batch API 중 어디에 속하는지 확인합니다.
API 키에는 독립적인 결제 등급이 없습니다. 같은 프로젝트의 여러 키는 프로젝트 사용량과 한도를 함께 씁니다. 프로젝트는 연결된 결제 계정의 사용 등급과 계정 상한을 상속합니다. 키를 여러 개 만든다고 처리량이 늘지 않습니다.

2026년 9월 기준 사용 등급 조건
2026년 9월 2일 기준 Gemini API 결제 안내에 적힌 조건은 다음과 같습니다. 월 상한과 10분 지출 한도는 특정 모델의 RPM이 아닙니다.
| 사용 등급 | 현재 조건 | 결제 계정 월 상한 | 최근 10분 지출 한도 |
|---|---|---|---|
| Free | 활성 프로젝트 또는 무료 체험 | 해당 없음 | 해당 없음 |
| Tier 1 | 활성 결제 계정 설정 및 연결 | $250 | $10 |
| Tier 2 | $100 결제 및 첫 성공 결제 후 3일 경과 | $2,000 | $200 |
| Tier 3 | $1,000 결제 및 첫 성공 결제 후 30일 경과 | $20,000~$100,000+ | $200 |
Tier 2와 Tier 3 자격에는 연결된 결제 계정 아래 프로젝트에서 발생한 Google Cloud 서비스 누적 지출이 반영됩니다. 하나의 Gemini API 키 비용만 세는 것이 아닙니다.
조건을 충족하면 원칙적으로 자동 승급됩니다. Free에서 Tier 1은 보통 즉시, 다음 등급은 보통 10분 안에 반영되지만 처리나 검토의 영향을 받을 수 있습니다. 결제 완료만 보고 추측하지 말고 AI Studio Projects에서 반영된 등급을 확인하세요.
최근 10분 지출 한도는 결제 이력과 계정 상태에 따라 적용됩니다. 요청 수와 입력 토큰이 각 한도보다 낮아도 고비용 요청이 짧은 시간에 몰리면 429 RESOURCE_EXHAUSTED가 발생할 수 있습니다.
RPM보다 먼저 닿을 수 있는 항목
Google이 설명하는 일반적인 세 항목은 다음과 같습니다.
- RPM: 분당 요청 수. 짧은 동시 요청 폭증에 민감합니다.
- 입력 TPM: 분당 입력 토큰 수. 긴 컨텍스트를 병렬로 보내면 적은 호출로도 도달합니다.
- RPD: 일일 요청 수. 태평양 시간 자정에 초기화됩니다.
이미지 생성 모델에는 IPM, 다른 모델에는 TPD 같은 별도 한도가 있을 수 있습니다. 적용되는 각 항목은 독립적으로 평가되므로 RPM에 여유가 있어도 입력 TPM, RPD, IPM, TPD 또는 지출 한도 때문에 요청이 거부될 수 있습니다.
현재 RPM과 입력 TPM을 알고 있다면 실제 처리량의 상한을 다음처럼 추정할 수 있습니다.
분당 처리 요청 ≈ min(현재 RPM, floor(현재 입력 TPM / 요청당 평균 입력 토큰))
이 식은 새 할당량이 아니라 용량 계획용 계산입니다. 같은 등급에서 짧은 질문을 긴 문서 입력으로 바꾸면 RPM보다 입력 TPM이 먼저 병목이 될 수 있습니다. Google은 명시된 한도를 보장하지 않으므로 최대값에 딱 맞추지 말고 변동 여유를 둡니다.
Priority와 Batch는 일반 요청과 다릅니다
Priority inference에는 별도 요청 한도가 있습니다. Google은 같은 모델·사용 등급의 표준 한도 대비 기본 0.3배를 안내하며, Priority 사용량은 전체 대화형 트래픽에도 포함됩니다. 일반 요청의 값을 Priority에 그대로 적용하면 안 됩니다.
Batch API도 Batch가 아닌 호출과 분리된 제한을 사용합니다. 현재 공개된 공통 제한은 동시 Batch 요청 100개, 입력 파일 2 GB, 파일 저장 20 GB와 모델·등급별 대기 토큰입니다. 모델 표는 자주 바뀌므로 현재 Batch 한도를 직접 확인하세요.
429가 나타난 형태에 맞춰 대응하세요
| 관찰 결과 | 가능성이 큰 한도 | 대응 |
|---|---|---|
| 동시 요청을 올린 직후 429 | RPM | 프로젝트 공용 대기열로 요청을 분산하고 동시 실행을 줄인 뒤 제한된 횟수로 재시도 |
| 호출 수는 적지만 입력이 큼 | 입력 TPM | 중복 컨텍스트를 제거하고 큰 병렬 입력을 줄이며 필요한 정보만 가져오기 |
| 하루 동안 지속 사용 후 중단 | RPD 또는 TPD | 안내된 초기화를 기다리거나 지속 수요에 맞는 유료 등급 평가 |
| 비싼 요청이 10분 안에 집중 | 지출 한도 | 최근 10분 구간이 지나기를 기다리고 입력/출력 비용을 줄이거나 한도 상향 요청 |
| Priority만 실패 | Priority 한도 | 전용 값을 확인하고 지연 조건이 허용할 때만 표준 요청 사용 |
| Batch 작업이 등록되지 않음 | 동시 작업 또는 대기 토큰 | 기존 작업 완료를 기다리고 배치를 줄이거나 해당 모델 표 확인 |
| Usage가 낮은데 계속 429 | 다른 프로젝트/모델, 등급 반영 지연, 용량 변동 | API 키와 프로젝트 연결, 모델 ID, 등급을 다시 확인하고 해당 정보를 포함해 상향 요청 |
사용 등급을 높여도 다른 프로젝트 Dashboard를 보고 있거나, 미리보기 모델의 한도가 더 낮거나, 모든 프로세스가 동시에 재시도하는 문제는 해결되지 않습니다.

일시적인 오류만 다시 시도하세요
Google 문제 해결 가이드는 429와 503 같은 일시적 오류에 지수 백오프, 무작위 지연, 최대 재시도 횟수를 사용하도록 권장합니다. 공식 SDK가 일부 오류를 자동 재시도하므로 별도 로직을 추가하기 전에 동작을 확인하세요.
백오프는 잠시 기다리는 방법일 뿐 RPM, TPM, RPD 또는 지출 용량을 늘리지 않습니다. 키마다 별도 제한기를 두기보다 프로젝트 공용 대기열이나 요청 제한기를 사용해야 동시 재시도 폭증을 줄일 수 있습니다.
400이나 403은 요청 형식, 모델/API 버전, 인증, 권한 문제인 경우가 많으므로 429처럼 반복하면 안 됩니다. Gemini API 오류 해결 가이드에서 구분할 수 있습니다.
현재 상태를 기록해 다음 변경에 대비하세요
운영 판단에는 날짜, 결제 계정, 프로젝트, 사용 등급, 전체 모델 ID, 요청 방식, 현재 RPM/TPM/RPD 또는 모델별 값, 평균 입력, 동시 실행 수, 최근 10분 최대 지출을 남기세요. 모델이나 조건이 바뀌어도 같은 방식으로 다시 계산할 수 있습니다.
무료 할당량이 프로토타입에 맞는지만 보려면 Gemini API 무료 할당량 안내를 사용하세요. 이 글은 모든 사용 등급에서 실제 처리량과 429 원인을 판단하는 데 초점을 둡니다.
사용 등급은 자격, AI Studio는 현재 프로젝트 정보, 실패한 요청은 진단 대상입니다. 세 가지를 나누면 Google이 한도 수치나 화면을 바꿔도 판단 절차는 유지됩니다.



