AIFreeAPI Logo
Actualizada en agosto • IDs oficiales • Estado de API

Guía de Modelos de IA 2026Texto • Imagen • Voz • Video

Compara los principales modelos de IA en agosto de 2026. Revisa los IDs, precios y usos de Claude Fable 5, GPT-5.6 Sol, Gemini 3.6 Flash y más.

Explorar modelos de IA
Actualizada en agosto • IDs oficiales • Estado de API
12
Modelos de IA
4
Categorías
100%
Comparación gratuita
2026
Datos recientes
Compara cuatro categorías por tarea, etapa de API y precio

Categorías de Modelos de IA 2026

IA de generación de texto

Actualizado ago. 2026
API GA y preview

LLM actuales para razonamiento, código y agentes, comparados por ID oficial, contexto, herramientas, etapa de API y precio.

Agente de código con IA
3 modelos

Claude Fable 5

Flagship
Claude más capazAnthropic2026-07

El modelo de Anthropic más capaz con disponibilidad general, pensado para razonamiento exigente, agentes de larga duración y trabajo complejo.

API global
Funciones clave
ID claude-fable-5
Contexto de 1M
Salida máxima de 128K

Precio

$10/M input + $50/M output

Actualizado

2026-07

OpenAI GPT-5.6 Sol

Flagship
Insignia GPT-5.6OpenAI2026-07

El modelo insignia de la familia GPT-5.6 para trabajo profesional complejo, programación, uso del ordenador y agentes de larga duración.

API global
Funciones clave
ID gpt-5.6-sol
Contexto de 1,05M
Salida máxima de 128K

Precio

$5/M input + $30/M output

Actualizado

2026-07

Google Gemini 3.6 Flash

GA
Flash estable recienteGoogle2026-07

La versión Flash estable más reciente de Google para flujos agentivos y multimodales, con equilibrio entre velocidad, capacidad y consumo de tokens.

API de Gemini (GA)
Funciones clave
ID gemini-3.6-flash
Contexto de 1M
Salida máxima de 64K

Precio

$1.50/M input + $7.50/M output

Actualizado

2026-07

IA de generación de imágenes

Actualizado ago. 2026
API de creación y edición

Modelos actuales de generación y edición de imagen para instrucciones complejas, tipografía, referencias múltiples y producción.

Diseño de marketing con IA
3 modelos

GPT Image 2

GA
Imagen recienteOpenAI2026-04

El modelo actual de OpenAI para generación y edición de imágenes, basado en el snapshot gpt-image-2-2026-04-21, con salida de alta calidad, tamaños flexibles e inputs de alta fidelidad.

API global
Funciones clave
modelo ID gpt-image-2
snapshot 2026-04-21
generación y edición

Precio

OpenAI image API pricing

Actualizado

2026-04

FLUX.2 Pro

GA
Imagen para producciónBlack Forest Labs2026-04

Modelo de Black Forest Labs para generación y edición de imágenes en producción, con flujos rápidos y soporte para varias referencias.

Disponible globalmente
Funciones clave
Generación y edición
Hasta 8 referencias
Flujos de producción

Precio

From $0.03/image

Actualizado

2026-04

Gemini 3 Pro Image

GA
Nueva generaciónGoogle2026-05

El modelo de imagen de Google para tareas complejas, fuerte en generación y edición multi-turno con razonamiento aplicado a imágenes.

API de Gemini
Funciones clave
Razonamiento visual complejo
Edición multi-turno
Texto preciso

Precio

~$0.13/image (1-2K)

Actualizado

2026-05

IA de síntesis de voz

Actualizado ago. 2026
API de voz y TTS

Modelos actuales de voz y TTS para razonamiento, herramientas, contexto multimodal, interrupciones y síntesis expresiva.

Agente de voz con IA
3 modelos

GPT-Realtime-2.1

GA
Voz con razonamientoOpenAI2026-07

Modelo de voz en tiempo real con razonamiento de OpenAI, mejorado para ruido, silencios e interrupciones en agentes de voz complejos.

API global
Funciones clave
ID gpt-realtime-2.1
Contexto de 128K
Entrada y salida de audio

Precio

$32/M audio input + $64/M output

Actualizado

2026-07

Gemini 3.1 Flash Live

Preview
Voz LiveGoogle2026-07

Modelo Gemini Live para diálogo de voz de baja latencia, con sensibilidad acústica, precisión numérica, entrada multimodal y herramientas.

API de Gemini (preview)
Funciones clave
ID gemini-3.1-flash-live-preview
Voz a voz
Baja latencia

Precio

$3/M audio input + $12/M output

Actualizado

2026-07

Eleven v3

GA
Voz naturalElevenLabs2026-02

El TTS principal actual de ElevenLabs, fuerte en control expresivo, instrucciones emocionales y entonación natural para voz premium.

Disponible globalmente
Funciones clave
Control por prompt
Expresión emocional
Clonación de voz

Precio

From $5/mo (30K chars)

Actualizado

2026-02

IA de generación de video

Actualizado ago. 2026
API de creación y edición

Modelos actuales de generación y edición de video para clips con audio, revisión conversacional, referencias multimodales y API.

Marketing de video con IA
3 modelos

Gemini Omni Flash

Preview
Edición conversacionalGoogle DeepMind2026-06

El modelo rápido que Google recomienda por defecto para crear y editar video de forma conversacional, con refinamientos en varios turnos.

API de Gemini (preview)
Funciones clave
ID gemini-omni-flash-preview
3-10 s a 720p
Edición conversacional

Precio

Gemini API preview pricing

Actualizado

2026-06

OpenAI Sora 2

API
Realismo físicoOpenAI2026-02

Modelo de video y audio de OpenAI con diálogos sincronizados, Cameos y varias resoluciones vía API.

API global
Funciones clave
API: $0.10-0.50/seg
Salida 720p-1792p
Diálogos sincronizados

Precio

$0.10/sec (720p) API

Actualizado

2026-02

Seedance 2.0

API
Video inmersivoByteDance Seed2026-03

El modelo de video más reciente de ByteDance Seed, fuerte en generación conjunta de audio y video y en control creativo con referencias multimodales.

Seed / Volcano Engine
Funciones clave
Generación conjunta audio-video
Referencias de imagen, audio y video
Control de nivel director

Precio

Contact sales

Actualizado

2026-03

Recomendado por expertos

Qué puedes comprobar en esta guía

Reduce opciones por tarea y valida el contrato y el precio actuales antes de integrar

ID de modelo vigente

Separa el nombre comercial del ID que llama la API

Límite de precio

Muestra la tarifa pública o la ruta oficial de precios

Etapa de acceso

Distingue entre GA, preview y acceso limitado

Ajuste a la tarea

Compara trabajos de texto, imagen, voz y video

Empezar ahora

¿Listo para empezar?

Elige la categoría adecuada y empieza a construir hoy

Comenzar gratis
Créditos API gratis
Soporte 24/7
Documentación completa