AIFreeAPI Logo

AI Studio 限流多久恢复?Gemini API 配额与重置时间

A
12 分钟阅读API 教程

只有日请求数耗尽,才应该等每日重置。分钟限流、输入过多、预付余额用完和地区访问受限,需要分别处理;先查到实际项目、模型和限制指标,再决定下一步。

Gemini API 限流与恢复概览,展示 RPM、TPM、RPD 和北京时间夏令时 15:00、冬令时 16:00 的日配额重置点

Gemini API 的每日请求数(RPD)在美国太平洋时间午夜重置,对应北京时间夏令时 15:00、冬令时 16:00。 截至 2026 年 9 月 6 日,美国太平洋时区实行夏令时,因此当天对应 15:00。这个规则适用于 API 的日请求配额,不能把 Google AI Studio 网页上的所有“已达限制”都解释成等到下午就会恢复。Google 官方速率限制说明

API 返回 429RESOURCE_EXHAUSTED 时,先看错误详情和实际额度:可能是每分钟请求太密、输入 token 太多,也可能确实用完当天请求。若是账单、地区或访问资格问题,日配额重置不会解决它。

先确认限制来自哪里

Google AI Studio 是开发与试用 Gemini 的工具;通过 API Key 发请求的 Gemini Developer API,按项目和模型的实际额度运行。你也可能在 AI Studio 内选择了付费项目的 API Key,使用会计费的功能。此时应检查该 Key 所属项目,不能只看浏览器登录的是哪个 Google 账号。AI Studio 与 API 计费说明

另一个容易混淆的产品是 Gemini 网页和手机应用。其个人账号帮助页有每 5 小时补充、受每周上限约束的额度说明,不能套到 AI Studio 或 Developer API 上。使用的是 Gemini 应用时,应以该产品的额度说明及界面提示为准。

如果 AI Studio 只显示笼统的网页提示,没有说明日配额、具体模型或恢复时间,先保留完整提示、操作时间和所用功能。能够确认是 API 项目调用时,再按下面的指标判断;仅凭一句“rate limit”无法得到可靠倒计时。

查实际额度,比查一张免费次数表更有用

打开 AI Studio 的速率限制页面,确认查看的是正在使用的项目和模型,再核对当前使用等级及可用限制。额度会随模型、项目和等级变化,预览或实验模型通常更严格;某个额度值也不是可用容量的保证。网上流传的“免费每天固定多少次”不能代替你的实际页面。官方说明

三个基本指标的处理方法不同:

查到的指标限制什么应怎样处理
RPM每分钟请求数减少并发,把请求均匀排队;临时失败使用有界重试
TPM每分钟输入 token 数减少每次输入及同时发送的输入总量,检查长历史和附件
RPD每天请求数确认日额度确实耗尽后,等待下一个太平洋时间午夜,或评估适用的付费额度

任意一项达到限制,都可能导致请求失败。“每天还剩很多次”并不意味着可以一秒内连续发送大量请求。部分模型还有每分钟图片数(IPM)或每天 token 数(TPD)等指标,按模型显示的指标处理;不要自动把 RPD 的重置规则扩展到所有其他指标。指标定义与适用范围

额度按项目计算,而不是每个 Key 单独拥有。两个程序如果使用同一个项目下的不同 Key,仍会共享相关额度。排查时要把定时任务、网页后端和本地脚本一起算进去;更换同项目的 Key 不会增加日请求配额。

可以先记录下面这些信息,后续判断就不必靠猜:

  • 实际使用的项目、模型 ID 和使用等级。
  • 错误发生时间、HTTP 状态码、完整错误文字,以及其中出现的配额指标。
  • 对应指标的当前用量和限制;是否还有其他程序使用同一项目。
  • 若使用付费功能,确认实际 Key 对应的项目、账单状态和预付余额。

记录和求助时隐藏 API Key;完整密钥不是诊断限流所需的信息。

从使用的产品、项目与模型查到实际配额,再区分分钟限制、日配额、账单与地区问题的排查图
从使用的产品、项目与模型查到实际配额,再区分分钟限制、日配额、账单与地区问题的排查图

日配额什么时候恢复:北京时间要分夏令时和冬令时

Google 写的是 midnight Pacific time,即美国太平洋时区的 00:00。中国不切换夏令时,但美国太平洋时区会在 PDT(UTC−7)与 PST(UTC−8)之间切换,因此不能全年固定写成北京时间 16:00。

太平洋时区状态当地日配额重置点对应北京时间
夏令时 PDT00:00当日 15:00
冬令时 PST00:00当日 16:00

例如,2026 年 9 月 6 日北京时间 14:40,若你已确认是 RPD 耗尽,下一个日配额重置点是当天 15:00,间隔 20 分钟。若在 15:10 才耗尽当日配额,下一次则是 9 月 7 日 15:00。2026 年 1 月 15 日属于冬令时,重置点是北京时间 16:00。这些是时区换算,不是某个账号的恢复测试。

安排定时任务时,使用 America/Los_Angeles 这个时区计算“下一个当地午夜”,比固定加 24 小时或全年固定北京时间更可靠。重置后也应逐步恢复队列,避免积压请求一起发出,立刻撞上 RPM 或 TPM。

这里还要区分两个问题:“每日配额何时重新计算”有明确规则,“这一条失败请求何时一定成功”没有统一保证。分钟级限制、其他程序继续消耗、模型可用容量及账单状态仍会影响请求结果。官方没有在上述说明中给出所有分钟指标统一的精确倒计时算法,不应把“稍后再试”改写成“等满 60 秒必定恢复”。

过了重置时间仍失败,按现象缩小范围

先重新发一条必要的小请求并查看当前错误;不要一恢复就重跑整个批次。接下来根据实际看到的内容处理:

当前现象优先核对下一步
错误指向分钟请求或输入指标并发、输入长度、其他调用者降速或缩短输入,按临时错误处理;不必等到次日
日请求数很快又满了是否看错项目、是否有后台程序持续调用暂停不必要任务,把该项目的调用集中记录和排队
对应模型的可用额度为 0模型、项目、等级与访问资格是否匹配先解决可用额度或配置问题,不能把 0 当成今天刚用完
付费项目仍被限制实际使用的 Key 是否属于该项目核对客户端配置与 AI Studio 选择的项目;升级另一个项目不会自动改变当前请求
预付余额为 0,或账单被暂停关联的 Cloud Billing 账户按账单页面处理;这类问题不会因日配额重置自动恢复
报地区、年龄或权限错误可用地区、账号资格、错误码按访问条件排查,停止围绕 RPD 反复等待

官方说明,预付账户余额归零后,相关服务会停止,不会自动降回免费层继续运行。即使余额非零,仍可能遇到其他限额或账单异常;账单图表还可能有最长 24 小时的更新延迟,不能只凭图表没有变化判断请求未产生用量。预付余额与账单排查

使用付费 API 的部分账户还有滚动 10 分钟消费速率限制。截至 2026 年 9 月 6 日,官方列出的 Tier 1、2、3 分别为每 10 分钟 10、50、200 美元,是否适用取决于账单历史与账户状态。这限制的是短时间花费速度,不能与充值余额或月度支出上限混为一谈。若错误确实来自这一限制,应减少昂贵请求、分散处理或等待消费窗口释放,而不是等日请求数重置。消费速率限制

中文界面和中文用户身份也不代表地区访问资格。当前官方支持地区列表未列中国大陆;AI Studio 还要求年满 18 岁,某些账号需要年龄验证。这里的北京时间换算仅用于看懂重置时间,不构成地区可用性的承诺。官方可用地区与年龄要求

把请求安排好,避免反复触发同一个限制

对于临时 429503,可以采用有上限的指数退避,并加上随机抖动,让多个请求不要在同一时刻重试。先确认所用 SDK 是否已经重试,再决定是否增加应用层重试;两层无限重试会让原本的拥堵更严重。错误响应若提供等待提示,可纳入安排,但不要假定每次都包含 Retry-After 或重试时间字段。Gemini API 错误排查

对已经确认的日配额耗尽,应暂停相关队列到下一个重置点;对额度为 0、账单暂停,以及需要修改参数或权限的 400403,先处理原因。短时间连续重试并不能把这几类问题变成临时拥堵。

输入长短同样影响可发送的频率。举一个假设算例,不代表任何模型的真实额度:某项目某模型的 TPM 上限是每分钟 100,000 个输入 token;平均每条请求输入 20,000 个 token,仅从这项指标估算,持续处理速度约为每分钟 5 条。如果输入降至每条 5,000 个 token,这项指标对应约每分钟 20 条。实际速度仍受 RPM、其他调用和突发情况约束,不能据此保证一次并发发送 20 条都成功。

长对话往往把更多历史和附件带入输入。模型的上下文长度表示单次请求能容纳的内容规模,既不是每日剩余 token,也不等于 TPM。可以按官方 token 计数方法检查实际输入量,再决定删去无关历史、缩短附件或拆分任务。新建聊天可能减少后续输入,但不会补回同一项目已经用掉的 RPD。

如果正常业务持续超过当前配额,再考虑付费和升级。先确认当前模型的付费额度是否满足需要、实际项目是否关联有效账单;不要把“绑卡”理解为所有 AI Studio 网页限制立即解除。具体计费关系可继续看Gemini API Key 怎么付费,申请或升级后的实际额度仍以 AI Studio 为准。

Gemini API 错误判断流程、太平洋午夜的当地时间换算,以及缩短输入后每分钟可处理请求数的假设算例
Gemini API 错误判断流程、太平洋午夜的当地时间换算,以及缩短输入后每分钟可处理请求数的假设算例