AIFreeAPI Logo

Límites de Google AI Studio: cuándo se restablecen y qué hacer si no puedes continuar

A
9 min readDesarrollo de API

Esperar puede resolver una cuota agotada, pero no un saldo a cero ni un chat demasiado largo. Comprueba primero el proyecto, el modelo y el indicador que ha provocado el aviso.

Portada sobre los límites y el restablecimiento de cuotas en Google AI Studio y la API de Gemini

La cuota de solicitudes diarias de la API de Gemini se restablece a medianoche del Pacífico. En España peninsular suele ser a las 09:00, aunque durante las semanas en las que no coinciden los cambios de hora de Estados Unidos y Europa pasa a las 08:00. Esa regla se refiere a las solicitudes por día, o RPD; no establece una hora de recuperación para cualquier aviso que aparezca en Google AI Studio. Google documenta el reinicio de RPD y el alcance de las cuotas.

Si necesitas continuar ahora, abre los límites activos en AI Studio, comprueba el proyecto y el modelo afectados y busca qué indicador se ha agotado. Ese dato permite decidir entre esperar, espaciar las solicitudes, reducir el contenido enviado o resolver un problema de facturación.

Qué límite has alcanzado

En la API, una solicitud puede fallar al superar cualquiera de las dimensiones aplicables, aunque las demás sigan teniendo margen. Además, las cuotas se comparten por proyecto: dos claves del mismo proyecto no aportan dos cuotas independientes.

Lo que muestra el aviso o el panelQué significaQué acción tiene sentido
RPMSolicitudes por minutoReducir la frecuencia y los envíos simultáneos; reintentar con pausas si el bloqueo es temporal.
TPMTokens de entrada por minutoReducir el contenido enviado y espaciar las solicitudes. Enviar menos solicitudes puede no bastar si cada una es muy grande.
RPDSolicitudes por díaSi la cuota diaria se ha consumido, esperar al siguiente reinicio a medianoche del Pacífico o revisar las opciones de cuota del proyecto.
Límite de contexto o chat demasiado largoEl contenido de una solicitud o conversación no cabe en el contexto del modeloAcortar el historial, quitar adjuntos innecesarios o empezar un chat con el contexto imprescindible.
Saldo prepago agotadoLa cuenta de facturación no tiene crédito disponibleRevisar la facturación; el reinicio diario no añade saldo.

RPM, TPM y RPD son las dimensiones principales que explica Google, pero algunos modelos tienen otras, como imágenes por minuto o tokens por día. Si aparece TPD, no deduzcas su hora de reinicio a partir de la regla de RPD: comprueba la condición indicada para ese límite. Las cifras concretas dependen del modelo, el proyecto y el nivel de uso, y los modelos experimentales o en vista previa pueden tener restricciones más estrictas. El límite publicado tampoco garantiza capacidad en todo momento. Fuente: límites de la API de Gemini.

No conviene diagnosticar con una tabla antigua de “solicitudes gratuitas de Gemini”. Anota el límite que muestra tu proyecto hoy y el identificador exacto del modelo que estás utilizando. Un nombre parecido o un modelo seleccionado en otra pestaña puede llevarte a consultar la cuota equivocada.

Ilustración sobre los límites de Google AI Studio y la API de Gemini
Ilustración sobre los límites de Google AI Studio y la API de Gemini

A qué hora vuelve la cuota diaria en España

Medianoche del Pacífico significa las 00:00 en la zona America/Los_Angeles, que alterna entre horario estándar y horario de verano. La conversión correcta depende de la fecha, también en España.

Fecha del reinicio en el PacíficoEspaña peninsular: Europe/MadridCanarias: Atlantic/Canary
15 de enero de 2026, 00:0015 de enero, 09:0015 de enero, 08:00
15 de marzo de 2026, 00:0015 de marzo, 08:0015 de marzo, 07:00
6 de septiembre de 2026, 00:006 de septiembre, 09:006 de septiembre, 08:00
28 de octubre de 2026, 00:0028 de octubre, 08:0028 de octubre, 07:00

Son conversiones horarias de la regla oficial de RPD, no observaciones de una cuenta concreta. Por ejemplo, si agotas esa cuota a las 23:00 del 6 de septiembre en Madrid, el siguiente reinicio corresponde a las 09:00 del 7 de septiembre. No tienes que esperar 24 horas desde tu última solicitud.

Para automatizar tareas, utiliza zonas horarias IANA y calcula la siguiente medianoche del Pacífico para cada fecha. Una tarea fijada para siempre a las 09:00 de Madrid dejaría de coincidir exactamente con el reinicio durante los periodos de desfase entre ambos cambios de hora.

Si el bloqueo continúa después de ese momento, comprueba el indicador de nuevo. Puede haberse restablecido RPD y seguir activo otro límite, o haber otro proceso consumiendo la cuota del mismo proyecto. El reloj por sí solo no identifica el problema.

El contador de tokens del chat no es un saldo diario

Una conversación larga puede incluir las instrucciones, los mensajes anteriores y los archivos que se envían al modelo. Ese contenido ocupa contexto y contribuye a los tokens de entrada de la solicitud. Por tanto, un contador elevado dentro de un chat no significa necesariamente que hayas gastado una supuesta “bolsa diaria de tokens”. La documentación de tokens de Gemini explica el contexto y cómo calcular la entrada con count_tokens.

Abrir un chat nuevo puede ayudar si el problema es el tamaño de la conversación: conserva solo las instrucciones, conclusiones y archivos necesarios para la siguiente tarea. Sin embargo, abrir otro chat no recarga RPD ni crea una cuota nueva para el proyecto. Esa diferencia explica por qué empezar de cero a veces permite continuar y otras veces devuelve exactamente el mismo error.

En una aplicación, revisa lo que realmente envías en cada llamada. Un historial que crece con cada turno puede hacer que TPM se agote antes que RPM. Recortar la respuesta máxima no resuelve por sí solo un exceso de tokens de entrada: primero hay que reducir o repartir la entrada.

Cómo actuar ante un 429 sin entrar en un bucle de reintentos

El estado 429 RESOURCE_EXHAUSTED indica que se ha agotado algún recurso o cuota aplicable. No permite concluir por sí solo que todo volverá en un minuto. Guarda el mensaje completo del error y, si los incluye, el indicador de cuota y el tiempo de espera sugerido. No todas las respuestas contienen esos datos.

  1. Confirma proyecto y modelo. Relaciona la clave que utiliza tu aplicación con el proyecto abierto en AI Studio. Revisa también tareas programadas y otras aplicaciones que comparten ese proyecto.
  2. Consulta el límite activo y el uso correspondiente. Si es RPD agotado, calcula el siguiente reinicio; si es RPM o TPM, reduce la presión sobre el servicio. Si la cuota aparece como cero, revisa acceso, modelo y nivel de uso antes de insistir.
  3. Comprueba la facturación cuando corresponda. Un saldo prepago a cero o una cuenta suspendida requiere resolver esa condición; una pausa breve no la cambia.
  4. Reintenta solo cuando haya una razón para esperar recuperación. Para errores temporales, aumenta progresivamente las pausas, añade una variación aleatoria y establece un máximo de intentos y de tiempo total. Revisa si tu SDK ya incorpora reintentos para no multiplicarlos con otro bucle externo.
  5. Haz una comprobación pequeña. Tras la espera o el cambio, prueba una solicitud breve con el mismo proyecto y modelo. Si funciona, recupera el ritmo gradualmente; si falla, conserva el nuevo error y contrástalo con el anterior.

La guía oficial de resolución de problemas distingue los errores de recursos, permisos, solicitudes y disponibilidad. Un 503 temporal puede justificar reintentos limitados; un 400 o un 403 suele requerir revisar la solicitud, los permisos o el acceso. Esperar al reinicio diario tampoco soluciona una restricción de región o edad: para AI Studio, comprueba las regiones y condiciones de acceso admitidas.

Si necesitas pedir ayuda, reúne la hora con su zona horaria, el modelo, el proyecto, el límite observado y el error completo, ocultando claves y datos sensibles. Así se puede distinguir una cuota consumida de un problema que persiste después de la espera.

Ilustración complementaria sobre las cuotas de Google AI Studio y la API de Gemini
Ilustración complementaria sobre las cuotas de Google AI Studio y la API de Gemini

Cómo ajustar la aplicación a las cuotas que tienes

Repartir las solicitudes evita ráfagas, pero también debes controlar su tamaño. Este ejemplo sirve para planificar; no representa una cuota gratuita real de Gemini:

  • Supón que el panel muestra 12 RPM y 60.000 TPM de entrada.
  • Si cada solicitud envía unos 8.000 tokens, siete solicitudes suman 56.000 tokens; ocho sumarían 64.000.
  • En ese caso, TPM limita el ritmo antes que RPM. Programar 12 solicitudes por minuto seguiría excediendo la cuota de entrada.

Como estimación inicial, divide el límite TPM entre los tokens de entrada habituales por solicitud y toma el menor resultado entre ese valor y RPM. Deja margen para entradas mayores y para otros consumidores del proyecto. La estimación ayuda a dimensionar la cola, pero no describe el algoritmo interno de las ventanas de Google ni garantiza que una ráfaga sea aceptada.

En la práctica, una cola compartida por proyecto permite espaciar los envíos y limitar la concurrencia de varios procesos. Cuenta los tokens de los casos más largos, evita adjuntar siempre archivos que ya no son necesarios y registra qué indicador provoca los rechazos. Aumentar el número de claves dentro del mismo proyecto no sustituye estos controles.

Qué cambia al activar la facturación

Google AI Studio suele poder utilizarse gratis, pero ciertas funciones utilizadas con una clave de API de un proyecto de pago pueden generar cargos. Comprueba qué clave y proyecto has seleccionado antes de interpretar la interfaz como gratuita en todos los casos. La clave hereda el proyecto y este, el nivel asociado a la cuenta de facturación. Fuente: facturación de la API de Gemini.

Los niveles de uso pueden ampliar las cuotas. Según las condiciones oficiales consultadas el 6 de septiembre de 2026, el nivel 1 requiere una cuenta de facturación activa vinculada; el nivel 2 exige 100 dólares estadounidenses de pagos acumulados y tres días desde el primer pago correcto; el nivel 3, 1.000 dólares estadounidenses y 30 días. Google considera el gasto acumulado de Google Cloud en la cuenta de facturación vinculada. La promoción suele ser automática y puede tardar hasta diez minutos después de cumplir los requisitos. Vincular una tarjeta, por sí solo, no equivale a cumplir los requisitos de los niveles superiores, y una solicitud de aumento no garantiza su aprobación. Condiciones de los niveles y aumentos de cuota.

Además, algunas cuentas de pago están sujetas a un límite de gasto en una ventana móvil de diez minutos, según su historial y estado. Es distinto de la cuota diaria, del saldo y de un tope mensual. Si ese es el límite que causa el rechazo, reducir las solicitudes más costosas o esperar a que baje el gasto dentro de la ventana puede ayudar; añadir saldo no elimina automáticamente ese límite.

En las cuentas prepago, el saldo cero detiene el servicio asociado a esa cuenta de facturación y no provoca un cambio automático al nivel gratuito. Revisa el saldo y el estado de la cuenta; las gráficas de facturación pueden llevar hasta 24 horas de retraso. Si has añadido crédito, ten en cuenta también el tiempo de propagación del cambio. Ninguna de esas situaciones se resuelve simplemente al llegar la hora de reinicio de RPD. Condiciones de prepago y facturación.

¿Se aplican estos horarios a la aplicación Gemini?

No debes trasladarlos a gemini.google.com ni a la aplicación móvil de Gemini. Gemini Apps, Google AI Studio y la API de Gemini tienen condiciones que hay que consultar en su propio producto. La ayuda de Gemini Apps sobre límites describe, para los casos personales a los que se aplica, reposiciones cada cinco horas hasta alcanzar el límite semanal. Esa regla no sustituye el reinicio de RPD de la API.

En AI Studio, si el aviso no identifica una cuota de API o no puedes relacionarlo con el proyecto y modelo del panel, no le asignes una hora universal. Conserva el texto exacto del aviso y consulta la ayuda correspondiente a esa función. La decisión útil es localizar primero qué se ha agotado: de ello depende que la solución sea esperar, reducir la entrada, bajar el ritmo o corregir la cuenta.