AIFreeAPI Logo

Gemini 3.8 Flash API: ID, precios, límites y migración

E
5 min readGuías de API

Gemini 3.8 Flash ya está en GA como `gemini-3.8-flash`: entrada de 1M, salida de 65k, herramientas para agentes y precio Standard de $0.75/$3.75 durante 2026.

Panel en español de Gemini 3.8 Flash con ID oficial, especificaciones, herramientas, precios, primera solicitud y migración desde 3.7

Google lanzó Gemini 3.8 Flash en disponibilidad general el 2 de septiembre de 2026. El identificador exacto de Gemini Developer API es gemini-3.8-flash. Google lo presenta como su Flash más inteligente para ingeniería de software de largo recorrido, agentes autónomos y procesos empresariales complejos.

Es el nuevo candidato principal entre los Flash estables, pero no obliga a sustituir de inmediato una integración 3.7 que funciona. Su tarifa Standard iguala a 3.7 hasta final de 2026 y se duplica el 1 de enero de 2027. La migración debe justificarse con calidad, latencia y coste por tarea aceptada.

Especificaciones oficiales

La ficha oficial publica este contrato:

PropiedadGemini 3.8 Flash
model IDgemini-3.8-flash
EstadoStable / GA
Entradastexto, imagen, vídeo, audio, PDF
Salidatexto
Límite de entrada1.048.576 tokens
Límite de salida65.536 tokens
thinking levellow, medium, high
ModalidadesStandard, Batch, Flex, Priority

Aceptar imágenes, vídeo y audio significa que puede comprenderlos, no generarlos. Gemini 3.8 Flash no admite generación de imagen o audio ni Live API. Esas salidas requieren modelos específicos.

Herramientas y exclusiones

Admite context caching, code execution, file search, function calling, structured output, Search y Maps grounding, URL context y computer use en Preview.

Hay tres límites especialmente relevantes:

  • minimal thinking devuelve un error; usa low, medium o high.
  • Image generation y audio generation no están disponibles.
  • Live API no está disponible.

Grounding, almacenamiento de caché, computer use y las modalidades de consumo tienen condiciones y unidades de cobro propias.

Precios de Gemini 3.8 Flash

La página oficial de precios usa dólares por millón de tokens. La salida incluye thinking tokens.

ModalidadEntrada hasta 31-12-2026Salida hasta 31-12-2026Entrada desde 01-01-2027Salida desde 01-01-2027
Standard$0.75$3.75$1.50$7.50
Batch$0.375$1.875$0.75$3.75
Flex$0.375$1.875$0.75$3.75
Priority$1.35$6.75$2.70$13.50

Standard y Priority muestran free tier; Batch y Flex no. La caché y el grounding se cobran aparte. Calcula entrada + thinking/salida + herramientas + grounding + caché + reintentos por tarea aceptada, no solo la tarifa de entrada.

Guía española para decidir cuándo migrar a Gemini 3.8 Flash con pruebas equivalentes, métricas de calidad y coste, canary, rollback y cambio de precio en 2027
Guía española para decidir cuándo migrar a Gemini 3.8 Flash con pruebas equivalentes, métricas de calidad y coste, canary, rollback y cambio de precio en 2027

Primera solicitud al API

La guía oficial de texto utiliza Interactions API:

python
from google import genai client = genai.Client() interaction = client.interactions.create( model="gemini-3.8-flash", input="Revisa los posibles fallos de este plan de despliegue.", ) print(interaction.output_text)

Con REST:

bash
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \ -H "x-goog-api-key: $GEMINI_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"gemini-3.8-flash","input":"Revisa los posibles fallos de este plan de despliegue."}'

Para comparar modelos, fija el mismo thinking_level, herramientas y timeout. Si hay thoughts o tool steps intercalados, procesa la respuesta completa en lugar de depender solo del campo de texto cómodo.

Operación de Gemini 3.8 Flash en producción con ciclo de evaluación, coste por tarea aceptada, observabilidad, alertas, configuración y presupuesto 2027
Operación de Gemini 3.8 Flash en producción con ciclo de evaluación, coste por tarea aceptada, observabilidad, alertas, configuración y presupuesto 2027

Migración desde Gemini 3.7 Flash

Las notas del 2 de septiembre llaman a 3.8 el Flash más inteligente y describen 3.7 como generación anterior. Es el posicionamiento de Google, no una victoria independiente en tus datos.

Compara solicitudes normales, contexto largo, structured output, tool failures, rechazos y conversaciones de varios turnos. Registra éxito al primer intento, precisión de tool calls, P50/P95, tokens, reintentos, fallos de seguridad y coste por tarea aceptada. Mantén ambos ID en configuración, empieza con un canary pequeño y conserva 3.7 como rollback rápido.

La elección más amplia entre Flash-Lite, Flash y Pro se trata en la guía independiente de modelos de texto Gemini. Esta página se dedica solo al contrato y migración de Gemini 3.8 Flash.

Conclusión

gemini-3.8-flash es hoy un modelo estable e invocable. Merece una evaluación prioritaria para ingeniería prolongada, agentes autónomos, herramientas complejas y contexto grande. Incluye en el presupuesto la subida de 2027 y amplía su tráfico solo cuando aporte una mejora medible.