AIFreeAPI Logo
更新至2026年9月 • 官方模型ID • API状态

2026 AI模型指南文本 • 图像 • 语音 • 视频

对比截至2026年9月的主流AI模型。快速查看Claude Fable 5.1、GPT-6 Astra、Gemini 3.8 Flash等模型的ID、价格边界与适用任务。

探索AI模型
更新至2026年9月 • 官方模型ID • API状态
12
AI模型
4
主要类别
100%
免费对比
2026
最新数据
按任务、API阶段与价格对比四大模型类别

2026年AI模型分类

文本生成AI

更新于 2026 年 9 月
GA 与预览 API

面向复杂推理、编程和智能体任务的当前LLM,对比官方模型ID、上下文窗口、工具能力、API阶段与价格。

AI编程代理
3 个模型

Claude Fable 5.1

Flagship
当前模型Anthropic2026-09

高难度推理、长时间运行的智能体与多步骤研究;适合常规模型仍无法完成的任务。

公开 API
核心特性
ID: claude-fable-5-1
1M 上下文
最大 128K 输出
自适应思考始终开启
缓存读取 $0.25/百万 token

GPT-6 Astra

Flagship
当前模型OpenAI2026-09

复杂编程、研究与文档任务;支持图像输入、工具调用和结构化输出。

公开 API
核心特性
ID: gpt-6-astra
1.05M 上下文
最大 128K 输出
推理与工具调用
输入 >272K 时整次请求加价

Gemini 3.8 Flash

GA
当前模型Google2026-09

兼顾成本的编程与多模态分析,接受文本、图像、视频、音频和 PDF,输出文本。

公开 API
核心特性
ID: gemini-3.8-flash
1M 输入 / 64K 输出
文本、图像、视频、音频输入
GA 稳定版
优惠价截至 2026-12-31

图像生成AI

更新于 2026 年 9 月
生成与编辑 API

当前图像生成与编辑模型,覆盖复杂指令、文字排版、多参考图和生产级素材工作流。

AI营销设计
3 个模型

GPT Image 2

GA
最新图像模型OpenAI2026-09

图像生成与编辑,适合需要遵循详细指令和保留参考图特征的素材制作。

公开 API
核心特性
ID: gpt-image-2
图像生成与编辑
灵活尺寸
高保真输入

更新

2026-09

FLUX.2 Pro

GA
生产级图像Black Forest Labs2026-09

多参考图生成与编辑,适合需要重复生产视觉素材的工作。

公开 API
核心特性
ID: flux-2-pro
生成与图像编辑
最多8张参考图
生产工作流
按分辨率计价
生成最低$0.03/图

更新

2026-09

Nano Banana Pro

GA
当前模型Google2026-09

复杂视觉指令、品牌一致性和精细设计;对应 Nano Banana Pro。

公开 API
核心特性
ID: gemini-3-pro-image
最高 4K 输出
复杂视觉指令
品牌一致性
稳定版 Nano Banana Pro

更新

2026-09

语音合成AI

更新于 2026 年 9 月
语音与 TTS API

当前实时语音与TTS模型,覆盖推理、工具调用、多模态上下文、打断处理和富有表现力的语音合成。

AI语音代理
3 个模型

GPT-Realtime-2.1

GA
推理型语音OpenAI2026-09

可被打断的实时语音对话,支持推理与工具调用,适合客服和语音智能体。

公开 API
核心特性
ID: gpt-realtime-2.1
128K上下文
音频输入与输出
推理与工具调用
改进打断处理

Gemini 3.1 Flash Live

Preview
Live语音Google2026-09

低延迟音频对话与多模态交互,通过 Live API 接入。

预览 API
核心特性
ID: gemini-3.1-flash-live-preview
gemini-3.1-flash-live-preview
音频到音频
低延迟
多模态输入
工具调用

更新

2026-09

Eleven v3

GA
自然语音ElevenLabs2026-09

富有表现力的配音、角色对话与旁白,支持音频标签控制语气。

公开 API
核心特性
ID: eleven_v3
提示词控制
情绪表达
声音克隆
多语言TTS
API可用

更新

2026-09

视频生成AI

更新于 2026 年 9 月
生成与编辑 API

当前视频生成与编辑模型,覆盖带音频短片、对话式修改、多模态参考和API工作流。

AI视频营销
3 个模型

Gemini Omni 1.1 Flash

GA
当前模型Google2026-09

通过自然语言反复修改短视频,适合对话式生成和编辑。

公开 API
核心特性
ID: gemini-omni-1.1-flash
3–10 秒音视频
默认 720p
对话式编辑与延长
1080p/4K 超分辨率输出

更新

2026-09

Veo 3.1

Preview
当前模型Google2026-09

需要同步音频和镜头控制的短片生成,可按制作要求选择 Standard、Fast 或 Lite。

预览 API
核心特性
ID: veo-3.1-generate-preview
音视频联合生成
镜头延长
尾帧控制
按秒计费

更新

2026-09

Seedance 2.5

API
当前模型ByteDance Seed2026-09

最长 30 秒的音视频联合生成,支持参考素材控制、视频延长与精细编辑。

平台确认
核心特性
最长 30 秒生成
多模态参考素材
视频延长与精细编辑
API ID 与报价在接入平台确认

更新

2026-09

专业推荐

这份指南帮你确认什么

先按任务筛选,再在接入前核对当前API合同与价格

当前模型ID

区分产品名与API实际调用ID

价格边界

展示公开API价格或官方价格入口

可用阶段

区分GA、预览与限量开放

任务匹配

按文本、图像、语音和视频任务对比

立即开始

准备开始了吗?

选择您的AI模型类别,开始构建

开始免费试用
免费API额度
24/7支持
全面文档