AIFreeAPI Logo

Лимиты AI Studio и Gemini API: когда ждать сброса и как восстановить запросы

A
7 min readРуководства по API

Суточная квота Gemini API обновляется в полночь по тихоокеанскому времени. Но сообщение об ограничении не всегда означает, что нужно ждать следующего дня: сначала проверьте показатель, модель и проект.

Лимиты Gemini API, время сброса RPD по Москве и проверки проекта, оплаты и доступа при ошибке 429

Если исчерпан RPD — суточное число запросов Gemini API, — ждать нужно до полуночи по тихоокеанскому времени (PT). По Москве это 10:00, пока в Калифорнии действует летнее время PDT, и 11:00 при зимнем PST. Минутные ограничения, пустой предоплаченный баланс и отказ в доступе по региону так не устраняются. Google указывает время суточного сброса в документации по лимитам Gemini API.

Чтобы выбрать следующий шаг, нужны три вещи: где возникла ошибка, какой проект и модель используются, что именно ограничено. Универсального количества бесплатных запросов для всех пользователей AI Studio нет: действующие значения следует проверять для своего проекта и модели.

Сначала выясните, к какому сервису относится сообщение

В Google AI Studio вы работаете в браузере, но часть функций может использовать выбранный API-ключ платного проекта. Поэтому надпись о лимите в интерфейсе ещё не объясняет, какая именно квота исчерпана. Сохраните полный текст сообщения, проверьте выбранную модель и, если используется платный ключ, его проект. Сам AI Studio обычно бесплатен; платные функции с таким ключом тарифицируются по связанному проекту. Это описано в справке Google об оплате.

В Gemini Developer API полезны HTTP-код и содержимое ответа: 429 RESOURCE_EXHAUSTED, название ограниченного показателя и подсказка о повторной попытке, если она есть. Один код 429 не позволяет отличить минутный всплеск от исчерпанного дневного лимита.

Приложение Gemini и Vertex AI проверяйте по их собственным правилам. Например, интервалы пополнения лимитов из справки приложения Gemini нельзя переносить на AI Studio или Developer API. Подписка в приложении также не подтверждает платный уровень проекта API.

Отдельный случай — доступность. На 6 сентября 2026 года Россия отсутствует в официальном списке поддерживаемых регионов AI Studio и Gemini API. Для AI Studio также требуется возраст от 18 лет, иногда с подтверждением. Если причина отказа связана с этими условиями, ожидание сброса квоты ничего не меняет. Московское время ниже — только пересчёт часов, а не обещание доступа из России.

Как понять, что именно закончилось

Откройте страницу действующих лимитов в AI Studio, выберите нужный проект и сопоставьте модель с той, которую вызывает приложение. Затем найдите показатель из сообщения об ошибке.

ПоказательЧто ограничиваетЧто делать при достижении предела
RPMЧисло запросов в минутуУменьшить частоту и параллельность, распределить запросы через очередь
TPMЧисло входных токенов в минутуСократить входные данные и объём истории; разнести большие запросы во времени
RPDЧисло запросов в суткиПриостановить соответствующую нагрузку до полуночи PT либо проверить доступный уровень квот
IPM, если есть у моделиЧисло изображений в минутуПланировать генерацию с учётом отдельного ограничения изображений
TPD, если есть у моделиЧисло токенов в суткиПроверить правило для этого показателя; время сброса RPD само по себе не доказывает такой же порядок для TPD

Лимиты действуют одновременно: запас по RPM не спасает запрос, если достигнут TPM. Квоты API применяются к проекту, а не к каждому ключу отдельно. Два приложения с разными ключами одного проекта могут расходовать общую квоту. Выпуск нового ключа в этом же проекте её не пополнит. Эти принципы и дополнительные показатели описаны в документации Google.

Не подставляйте числа из старой таблицы в интернете. Лимиты зависят от модели и уровня проекта, а у предварительных и экспериментальных моделей ограничения могут быть строже. Даже указанная квота не является гарантией доступной мощности в любой момент.

Когда восстанавливается суточная квота

Для RPD отсчёт привязан к календарному дню в тихоокеанском часовом поясе. Это не 24 часа с момента первой ошибки и не полночь по вашему местному времени.

Время в КалифорнииПолночь PT по Москве
Летнее, PDT — UTC−710:00 того же календарного дня
Зимнее, PST — UTC−811:00 того же календарного дня

Например, 6 сентября 2026 года действует PDT. Если RPD закончился в 09:40 по Москве, ближайшая граница суточного сброса — 10:00, через 20 минут. Если он закончился в 10:20, следующая граница — 10:00 7 сентября, через 23 часа 40 минут. Эти интервалы рассчитаны для указанных дат; в дни перевода часов время нужно пересчитывать по часовому поясу America/Los_Angeles.

Сброс RPD снимает именно препятствие по суточному числу запросов. Если параллельно исчерпан другой лимит или приостановлен биллинг, запрос всё ещё может завершиться ошибкой. После границы сброса отправьте один обычный запрос, а затем постепенно возобновляйте очередь, чтобы не создать новый всплеск RPM или TPM.

Для минутных показателей не стоит обещать восстановление ровно через 60 секунд после ошибки: официальное описание единиц измерения не раскрывает универсальный алгоритм учёта для всех случаев. Остановите поток, учитывайте подсказку сервера о задержке, когда она присутствует, и повторяйте ограниченное число раз.

Почему даже платный проект может вернуть 429

Начните с соответствия ключа проекту. Включённая оплата у проекта A не меняет запросы, которые по-прежнему отправляются ключом проекта B. В AI Studio проверьте фактически выбранный ключ; в приложении — настройки окружения и проект этого ключа. Сам секретный ключ не нужно публиковать в логах или отправлять в обращении за помощью.

По действующим условиям уровней Gemini API на 6 сентября 2026 года:

  • Tier 1 требует привязанного активного платёжного аккаунта.
  • Tier 2 требует не менее 100 долларов США совокупных оплаченных расходов Google Cloud по связанному платёжному аккаунту и не менее трёх дней после первого успешного платежа.
  • Tier 3 требует не менее 1000 долларов США таких расходов и не менее 30 дней после первого успешного платежа.

Речь об оплаченных расходах, а не просто о добавленной карте или установленном бюджете. Повышение обычно происходит автоматически; после выполнения условий обновление может занять до 10 минут. Проверяйте итоговый уровень и активные лимиты, прежде чем увеличивать нагрузку. Запрос дополнительной квоты не гарантирует её одобрения, а платный ключ не обещает снятия всех ограничений веб-интерфейса Studio.

У части платных аккаунтов есть ещё ограничение расходов за скользящие 10 минут. Google приводит 10 долларов США для Tier 1, 50 — для Tier 2 и 200 — для Tier 3; применимость зависит от истории платежей и состояния аккаунта. Это не месячный бюджет и не остаток на счёте. Если достигнут именно этот предел, уменьшите стоимость и частоту запросов и дайте прежним расходам выйти из десятиминутного окна. Ожидание полуночи здесь не является необходимым условием.

При нулевом предоплаченном балансе сервисы по этому платёжному аккаунту останавливаются и автоматически на бесплатный режим не переходят. Проверьте баланс и состояние оплаты по правилам биллинга Google. Суточный сброс баланс не пополняет. При этом положительный баланс не отменяет лимиты модели, а графики расходов могут обновляться с задержкой до 24 часов.

Схема квот Gemini API, суточного сброса по Москве и проверки платного проекта
Схема квот Gemini API, суточного сброса по Москве и проверки платного проекта

Уточнение к схеме: пределы расходов 10, 50 и 200 долларов США относятся к скользящему окну в 10 минут и действуют только для аккаунтов, к которым Google применяет это ограничение. Наличие Tier 1, 2 или 3 само по себе не подтверждает его применимость.

Как возобновить работу и не получить новую волну ошибок

Для временной перегрузки полезно ограниченное число повторов с экспоненциальной задержкой и небольшим случайным разбросом. Например, клиент может увеличивать паузы между попытками и прекращать их после заданного числа неудач. Это рекомендация по поведению приложения, а не расписание сброса квоты. Проверьте, не выполняет ли SDK повторы самостоятельно: несколько вложенных механизмов могут умножить число запросов.

Google различает временные ошибки, включая 429 и 503, и ошибки запроса или доступа. При 400 сначала исправляют запрос, при 403 проверяют права и применимые условия доступа; слепой цикл повторов здесь не помогает. Основа разбора — официальная справка по ошибкам Gemini API.

Для постоянной нагрузки настройте общий учёт хотя бы на уровне проекта и модели. Учитывайте все приложения, фоновые задания и повторные попытки, которые используют этот проект. Разделение нагрузки по ключам не должно создавать иллюзию независимых квот.

Оценить узкое место можно до запуска. Допустим, в учебном примере, не в тарифе Google, проекту доступны 12 RPM и 120 000 входных TPM. При среднем входе 15 000 токенов получаем 120 000 / 15 000 = 8 запросов в минуту: первым сработает TPM, хотя по RPM разрешено 12. В реальном приложении оставьте запас на неодинаковый размер запросов и распределяйте их во времени — среднее за минуту не разрешает отправлять всю порцию одновременно.

Длинная беседа тоже увеличивает нагрузку: история и вложения могут входить в очередной запрос. Для оценки входа используйте подсчёт токенов, описанный в документации Gemini. Новый чат может уменьшить объём передаваемой истории, но не возвращает потраченные запросы RPD. Предельная длина контекста модели, минутный TPM и дневная квота — разные ограничения.

Схема диагностики ошибки 429 с проверкой проекта, квот и оплаты; уточнения к времени и полям ответа приведены ниже
Схема диагностики ошибки 429 с проверкой проекта, квот и оплаты; уточнения к времени и полям ответа приведены ниже

В таблице городов на схеме неверно указано зимнее время Нью-Йорка и Мадрида. Полночь PT обычно соответствует 03:00 в Нью-Йорке при обоих сезонных режимах и 09:00 в Мадриде; в периоды несовпадения перевода часов в США и Европе — 08:00 в Мадриде. Название ограниченного показателя и подсказка о сроке повтора присутствуют не в каждом ответе 429: если их нет, сопоставьте ошибку с действующими лимитами проекта.

Если ожидаемое время прошло, а ошибка осталась

Сопоставьте новый ответ с прежним: сохранились ли модель, проект и название ограниченного показателя. Возможно, RPD уже обновился, а теперь запрос упирается в TPM; возможно, приложение всё ещё использует другой ключ. Проверьте активные лимиты, баланс, статус оплаты и доступность сервиса для аккаунта.

Если причина не ясна, подготовьте для поддержки время ошибки с часовым поясом, идентификатор проекта, точный ID модели, HTTP-код, текст ошибки без секретов и значения соответствующих лимитов. Укажите, что уже проверили и изменился ли результат после паузы. Эти данные помогают отличить квоту от проблемы доступа или временного сбоя и дают основание для следующего действия.