AIFreeAPI Logo

Gemini 3.8 Flash API 指南:型号、价格、规格与迁移

A
5 分钟阅读API Guides

Gemini 3.8 Flash 已以 `gemini-3.8-flash` 正式 GA,支持 1M 输入、65k 输出和核心代理工具;2026 年标准输入/输出价格为每百万 token $0.75/$3.75。

Gemini 3.8 Flash 中文 API 面板,展示正式 ID、规格、工具、非支持项、价格、首次请求和迁移评测

Google 已在 2026 年 9 月 2 日正式发布 Gemini 3.8 Flash,版本状态为 GA,准确的 Gemini Developer API 型号是 gemini-3.8-flash。Google 将它定位为面向长周期软件工程、自主代理与复杂企业工作流的最强 Flash 模型。

这让 3.8 成为新的稳定 Flash 首选候选,但不等于所有 3.7 系统都应立即迁移。它在 2026 年底前与 3.7 使用同一组标准促销价,2027 年 1 月 1 日起价格翻倍。是否升级仍要看自己的任务成功率、延迟、token 与每个成功任务成本。

Gemini 3.8 Flash 官方规格

官方型号页给出的合同如下:

项目Gemini 3.8 Flash
model IDgemini-3.8-flash
状态Stable / GA
输入文本、图片、视频、音频、PDF
输出文本
输入上限1,048,576 token
输出上限65,536 token
thinking levellowmediumhigh
调用模式Standard、Batch、Flex、Priority

“可接收图片、视频和音频”表示理解能力,不表示可以生成这些媒体。Gemini 3.8 Flash 不支持图片生成、音频生成和 Live API;需要这些输出时,应使用对应的专用模型。

支持的工具与容易踩错的边界

3.8 Flash 支持上下文缓存、代码执行、file search、function calling、结构化输出、Google Search 与 Maps grounding、URL context,以及 Preview 状态的 computer use。

三个限制会直接影响实现:

  • minimal thinking 不受支持,会返回错误;只能使用 lowmediumhigh
  • 不支持图片生成和音频生成。
  • 不支持 Live API。

工具支持也不等于所有功能按同一单位收费。grounding、缓存存储、computer use 和不同调用模式各有独立条件,接入时要按真实使用组合核算。

Gemini 3.8 Flash 价格

Google 官方价格页以美元/每百万 token 计价,输出价格包含 thinking tokens。

模式2026 年底前输入2026 年底前输出2027 年起输入2027 年起输出
Standard$0.75$3.75$1.50$7.50
Batch$0.375$1.875$0.75$3.75
Flex$0.375$1.875$0.75$3.75
Priority$1.35$6.75$2.70$13.50

Standard 与 Priority 当前显示免费层,Batch 和 Flex 不显示。缓存 token、按小时存储、Search 和 Maps grounding 也有单独规则。只看输入单价会低估真实账单:

每个成功任务成本 = 输入 + thinking/输出 + 工具 + grounding + 缓存 + 重试

Gemini 3.8 Flash 中文规格与迁移总览,包含 model ID、上下文、价格、工具、限制和 3.7 对照评测流程
Gemini 3.8 Flash 中文规格与迁移总览,包含 model ID、上下文、价格、工具、限制和 3.7 对照评测流程

3.8 如果能减少重试或一次完成复杂工具链,实际可能更省;如果任务本来不需要它,输出变长也可能增加成本。

发出第一个请求

Google 当前的文本生成指南使用 Interactions API。Python 示例:

python
from google import genai client = genai.Client() interaction = client.interactions.create( model="gemini-3.8-flash", input="检查这份部署方案的失败条件。", ) print(interaction.output_text)

REST 请求:

bash
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \ -H "x-goog-api-key: $GEMINI_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gemini-3.8-flash", "input": "检查这份部署方案的失败条件。" }'

第一次请求可先沿用默认 thinking。需要严格比较延迟与成本时,再明确设置 thinking_level,并让新旧模型使用相同配置。若返回内容夹杂 thoughts、工具步骤或其他块,不要只依赖便利的文本字段,应按完整响应结构读取。

要不要从 Gemini 3.7 Flash 迁移

9 月 2 日更新日志把 3.8 列为 GA,并称它是当前最智能的 Flash;3.7 已被描述为上一代。这是 Google 的产品定位,不是你私有任务上的独立结论。

迁移评测应固定 prompt、工具、thinking level、timeout 和合格标准,覆盖正常请求、长上下文、结构化输出、工具失败、安全拒绝与多轮状态。记录首次成功率、工具调用正确率、P50/P95、入输出 token、重试、安全失败与每个成功任务成本。把 3.7 和 3.8 都放在配置中,先给 3.8 小流量,再决定是否扩大。

Gemini 3.8 Flash 中文迁移评测流程,展示任务集、固定配置、并行运行、指标记录、完整响应处理和生产接入架构
Gemini 3.8 Flash 中文迁移评测流程,展示任务集、固定配置、并行运行、指标记录、完整响应处理和生产接入架构

如果你还需要在 Flash-Lite、Flash 和 Pro 之间做更宽的选择,可以查看独立的 Gemini 文本模型指南。本页只负责 Gemini 3.8 Flash 的规格、接入与迁移。

结论

gemini-3.8-flash 现在已经是可调用的稳定型号。它最值得测试的场景是长周期软件工程、自主代理、复杂工具使用和大上下文任务。2026 年的促销价具有吸引力,但必须把官方公布的 2027 年涨价纳入预算,并用自己的任务证明迁移价值。