AIFreeAPI Logo

Gemini 3.8 Flash API 가이드: 모델 ID, 가격, 사양과 전환

A
2 min readAPI 가이드

Gemini 3.8 Flash는 `gemini-3.8-flash`로 GA 출시됐습니다. 입력 1M, 출력 65k, 핵심 에이전트 기능을 지원하며 2026년 Standard 가격은 $0.75/$3.75입니다.

Gemini 3.8 Flash 한국어 API 가이드 표지로 공식 ID, 사양, 지원 도구, 가격, 첫 요청과 3.7 전환을 표시

Google은 2026년 9월 2일 Gemini 3.8 Flash를 정식 버전(GA)으로 출시했습니다. Gemini Developer API의 정확한 모델 ID는 gemini-3.8-flash입니다. Google은 장기 소프트웨어 엔지니어링, 자율 에이전트, 복잡한 기업 작업을 위한 가장 지능적인 Flash로 설명합니다.

새로운 안정형 Flash의 우선 평가 후보지만 모든 3.7 시스템을 즉시 바꿀 이유는 아닙니다. 2026년 말까지 Standard 가격은 3.7과 같고 2027년 1월 1일부터 두 배가 됩니다. 실제 작업의 성공률, 지연, token, 채택 가능한 결과 한 건의 비용으로 전환을 결정하세요.

공식 사양

공식 모델 페이지는 다음 계약을 게시합니다.

항목Gemini 3.8 Flash
model IDgemini-3.8-flash
상태Stable / GA
입력text, image, video, audio, PDF
출력text
입력 한도1,048,576 token
출력 한도65,536 token
thinking levellow, medium, high
사용 방식Standard, Batch, Flex, Priority

이미지, 동영상, 오디오를 이해할 수 있지만 미디어를 생성하지는 않습니다. image generation, audio generation, Live API는 지원하지 않으므로 해당 출력은 전용 모델을 사용해야 합니다.

도구 지원과 제한

context caching, code execution, file search, function calling, structured output, Search/Maps grounding, URL context와 Preview computer use를 지원합니다.

구현 전에 세 가지를 확인하세요.

  • minimal thinking은 오류를 반환하며 low, medium, high만 지원합니다.
  • image generation과 audio generation은 지원하지 않습니다.
  • Live API는 지원하지 않습니다.

grounding, cache storage, computer use와 사용 방식은 각각 조건과 과금 단위가 다릅니다.

Gemini 3.8 Flash의 지원 도구, 도구별 조건과 과금, 미지원 기능, thinking level 제한과 구현 체크리스트를 보여 주는 한국어 안내도
Gemini 3.8 Flash의 지원 도구, 도구별 조건과 과금, 미지원 기능, thinking level 제한과 구현 체크리스트를 보여 주는 한국어 안내도

Gemini 3.8 Flash 가격

Google 가격표는 100만 token당 미국 달러 기준이며 출력 가격에는 thinking tokens가 포함됩니다.

방식2026년 입력2026년 출력2027년 입력2027년 출력
Standard$0.75$3.75$1.50$7.50
Batch$0.375$1.875$0.75$3.75
Flex$0.375$1.875$0.75$3.75
Priority$1.35$6.75$2.70$13.50

Standard와 Priority에는 free tier가 표시되고 Batch와 Flex에는 없습니다. cache와 grounding은 별도입니다. 실제 비용은 입력 + thinking/출력 + 도구 + grounding + cache + 재시도로 계산하세요.

첫 API 요청

현재 텍스트 생성 가이드는 Interactions API를 사용합니다.

python
from google import genai client = genai.Client() interaction = client.interactions.create( model="gemini-3.8-flash", input="이 배포 계획의 실패 조건을 검토해 주세요.", ) print(interaction.output_text)

REST 요청:

bash
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \ -H "x-goog-api-key: $GEMINI_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"gemini-3.8-flash","input":"이 배포 계획의 실패 조건을 검토해 주세요."}'

모델 비교에서는 thinking_level, 도구와 timeout을 동일하게 고정합니다. thoughts나 tool steps가 섞인 응답은 편의용 text 필드만 보지 말고 전체 응답 구조를 처리하세요.

Gemini 3.8 Flash를 선택할 작업, 실제 비용 계산, 전환 전 평가 지표와 작은 A/B canary 절차를 정리한 한국어 가이드
Gemini 3.8 Flash를 선택할 작업, 실제 비용 계산, 전환 전 평가 지표와 작은 A/B canary 절차를 정리한 한국어 가이드

Gemini 3.7 Flash에서 바꿔야 할까

9월 2일 릴리스 노트는 3.8을 GA이자 가장 지능적인 Flash로 소개하고 3.7을 이전 세대로 설명합니다. 이는 Google의 제품 설명이며 자신의 데이터에서 나온 독립 결론은 아닙니다.

일반 요청, 긴 문서, structured output, tool failure, 안전 거부, 여러 대화를 포함한 고정 세트로 비교합니다. 첫 시도 성공률, tool call 정확도, P50/P95, token, 재시도, 안전 실패, 작업 한 건의 총비용을 기록하세요. ID는 설정에서 바꾸고 작은 canary로 시작하며 3.7 rollback을 유지합니다.

Flash-Lite와 Pro까지 포함한 선택은 별도의 Gemini 텍스트 모델 가이드에서 다룹니다. 이 글은 Gemini 3.8 Flash의 계약과 전환만 설명합니다.

결론

gemini-3.8-flash는 지금 호출 가능한 안정형 모델입니다. 장기 소프트웨어 개발, 자율 에이전트, 복잡한 tool use, 큰 context에서 먼저 평가할 가치가 있습니다. 2027년 가격 인상을 예산에 반영하고 실제 개선이 확인된 작업부터 단계적으로 전환하세요.