Saltar al contenido

Qué modelo de texto de OpenAI usar en la API: GPT-6 o GPT-5.6

Sol y Luna existen en GPT-6 y GPT-5.6 con precios distintos: cuál probar primero, qué sustituye a gpt-4o-2024-05-13, o3 o gpt-5-mini y qué cambia en la UE.

•••16 min de lectura•Comparación de modelos de IA
Infografía de la familia GPT-5.6 con los IDs gpt-5.6-sol, gpt-5.6-terra y gpt-5.6-luna, sus precios por millón de tokens y un ejemplo de coste

A 25 de septiembre de 2026, la API de OpenAI tiene dos generaciones de modelos de texto activas a la vez: GPT-6 (Astra, Sol y Luna; Sol y Luna salieron el 22 de septiembre) y GPT-5.6 (Sol, Terra y Luna). Sol y Luna existen en las dos, con precios distintos, así que «Sol» o «Luna» sin la generación no identifica un modelo ni una tarifa.

Si empiezas una integración hoy, el primer candidato razonable es gpt-6-sol: por token cuesta lo mismo o menos que gpt-5.6-terra y la mitad que gpt-5.6-sol. Pasa a gpt-6-astra, cinco veces más caro por token, solo en las tareas que GPT-6 Sol no apruebe en tus pruebas, y prueba gpt-6-luna para clasificación, extracción y lotes con una validación automática.

Cuatro situaciones cambian esa elección:

  • Tienes en producción un modelo con fecha de apagado (23 de octubre o 11 de diciembre de 2026): el reemplazo que indica OpenAI es siempre un GPT-5.6; GPT-6 es una alternativa que tienes que probar tú. La tabla de migración lo detalla modelo por modelo.
  • Usas Chat Completions con herramientas: con GPT-6 Sol y Luna solo funciona el function calling con reasoning_effort: "none"; para razonar y llamar herramientas necesitas Responses.
  • Tu empresa exige residencia de datos en la UE: con GPT-6 solo hay procesamiento Standard, sin el 50 % de descuento de Batch ni de Flex.
  • Tus peticiones superan los 272.000 tokens de entrada: la petición entera se factura a una tarifa más alta, y el salto es brusco.

OpenAI no da una sola recomendación: su catálogo de modelos propone empezar por Astra y usar GPT-5.6 Terra y GPT-5.6 Luna para equilibrar o abaratar, mientras que la guía de GPT-6 reparte esos mismos papeles entre Astra, GPT-6 Sol y GPT-6 Luna. Más abajo tienes las dos versiones textuales.

GPT-6 y GPT-5.6: dos generaciones con nombres repetidos

Astra solo existe en GPT-6 y Terra solo en GPT-5.6. Sol y Luna aparecen en ambas. Las tarifas son las estándar de la página de precios de OpenAI para contexto corto (hasta 272.000 tokens de entrada), en dólares por millón de tokens y sin IVA:

Generación y nivelID de la APIEntradaEntrada en cachéSalidaFecha de corte
GPT-6 Astragpt-6-astra10 $1 $50 $30 de abril de 2026
GPT-6 Solgpt-6-sol2 $0,20 $10 $20 de abril de 2026
GPT-6 Lunagpt-6-luna0,10 $0,01 $0,50 $18 de mayo de 2026
GPT-5.6 Solgpt-5.6-sol4 $0,40 $20 $16 de febrero de 2026
GPT-5.6 Terragpt-5.6-terra2 $0,20 $12 $16 de febrero de 2026
GPT-5.6 Lunagpt-5.6-luna0,20 $0,02 $1,20 $16 de febrero de 2026

El precio de GPT-5.6 Sol es promocional: OpenAI indica que se mantiene al menos hasta el 21 de noviembre de 2026 y no ha publicado el de después. La escritura en caché cuesta 1,25 veces la entrada sin caché (2,50 $ en GPT-6 Sol y Terra, por ejemplo).

Algunas relaciones que se leen directamente en la tabla:

  • GPT-6 Sol frente a GPT-5.6 Terra: la misma entrada, la misma entrada en caché y la misma escritura en caché; la salida baja de 12 $ a 10 $. GPT-6 Sol nunca es más caro por token que Terra.
  • GPT-6 Sol frente a GPT-5.6 Sol: la mitad en todas las tarifas, incluso con el precio promocional de GPT-5.6 Sol.
  • GPT-6 Luna frente a GPT-5.6 Luna: la mitad en la entrada y 0,50 $ frente a 1,20 $ en la salida.
  • GPT-6 Astra frente a GPT-6 Sol: cinco veces más en todas las tarifas.

Lo que no sirve para elegir entre los seis es el tamaño: según sus fichas, todos tienen una ventana de contexto de 1.050.000 tokens (hasta 922.000 de entrada), 128.000 tokens de salida máxima, entrada de texto e imagen y salida de texto. Las diferencias técnicas son otras:

  • Esfuerzo de razonamiento: GPT-6 Sol, GPT-6 Luna y los tres GPT-5.6 admiten none, low, medium (predeterminado), high, xhigh y max. Astra no admite none: empieza en low.
  • Alias: gpt-5.6 no es un cuarto modelo; enruta a GPT-5.6 Sol. Si necesitas resultados reproducibles, registra el ID concreto que respondió.
  • Equivalencias con familias anteriores: la ficha de Terra lo sitúa aproximadamente en el antiguo nivel mini y la de GPT-5.6 Luna en el nivel nano.
  • Límites de tasa: en el Tier 1 los seis tienen 500 peticiones y 500.000 tokens por minuto. En el Tier 5, GPT-6 Luna y GPT-5.6 Luna llegan a 30.000 peticiones y 180 millones de tokens por minuto; los otros cuatro, a 15.000 y 40 millones.

Qué recomienda OpenAI (y dónde no coincide consigo misma)

El catálogo de modelos dice textualmente: «If you're not sure where to start, use GPT-6 Astra […] Choose GPT-5.6 Terra to balance intelligence and cost, or GPT-5.6 Luna for cost-sensitive, high-volume workloads». Sus modelos destacados son Astra, GPT-5.6 Terra y GPT-5.6 Luna.

La guía de GPT-6 propone otro reparto: gpt-6-astra «for our highest level of capability», gpt-6-sol «for strong reasoning on demanding tasks» y gpt-6-luna «for efficient, repeatable work at scale». La guía pide elegir según el razonamiento que requiere la tarea, la latencia y el coste.

Las dos páginas coinciden en la parte alta (Astra) y difieren en el nivel medio y el bajo: el catálogo sigue apuntando a GPT-5.6 Terra y GPT-5.6 Luna, la guía a GPT-6 Sol y GPT-6 Luna. OpenAI no explica la diferencia. Lo que sí puedes comprobar es el precio: para el papel de «equilibrio», GPT-6 Sol cuesta por token lo mismo o menos que Terra; para el de «volumen barato», GPT-6 Luna cuesta menos que GPT-5.6 Luna en todas las tarifas. La documentación de OpenAI no compara la calidad de GPT-6 Sol y Terra en cargas reales; esa pregunta solo la responde una prueba con tus propias tareas.

Qué ID probar primero según tu carga

Tareas difíciles, código y agentes

Empieza con gpt-6-sol. OpenAI lo describe como el modelo para programación compleja y flujos de agentes, y cuesta la quinta parte que Astra por token.

Pasa a gpt-6-astra en las tareas donde Sol falle de forma repetida una prueba de aceptación clara, o donde un fallo cueste más que la diferencia de precio. OpenAI afirma, a partir de sus propias evaluaciones, que Astra genera sustancialmente menos tokens de salida y que su coste estimado por tarea es menor que el de modelos anteriores pese a su tarifa; es una afirmación del proveedor que solo tu medición confirma para tu caso. Si comparas Astra con modelos de Anthropic, la comparativa GPT-6 Astra vs Claude Fable 5.1: cuánto cuesta realmente la API entra en el detalle.

Uso general: chat, soporte, salidas estructuradas

Aquí el catálogo apunta a GPT-5.6 Terra y la guía de GPT-6 a GPT-6 Sol. Con los mismos tokens, GPT-6 Sol cuesta igual o menos, y además tiene una fecha de corte de conocimiento dos meses posterior. Pruébalo primero; quédate en Terra si ya lo tienes validado en producción y la prueba no muestra ninguna mejora que justifique el cambio.

Mucho volumen y poco margen

Para clasificar, extraer campos, normalizar formatos o preprocesar lotes, prueba gpt-6-luna. Funciona bien cuando hay un esquema estricto, una validación programática y una ruta de reserva: si la respuesta no pasa, se reenvía a Sol. Sin esa validación, el ahorro por token puede acabar gastado en revisión manual.

Cuándo sigue teniendo sentido GPT-5.6

GPT-5.6 no tiene fecha de apagado anunciada y es el reemplazo que indica OpenAI para todos los modelos de texto que se apagan en octubre y diciembre de 2026. Tiene sentido mantenerlo o elegirlo cuando:

  • ya tienes un GPT-5.6 validado y la prueba con GPT-6 no mejora ni la calidad ni el coste por tarea aceptada;
  • trabajas con residencia de datos en la UE y tu carga puede ir por Batch (lo explica la sección de la UE);
  • necesitas un comportamiento idéntico al de la versión que ya auditaste.

GPT-5.6 Sol queda en una posición difícil: cuesta el doble que GPT-6 Sol en todas las tarifas y su precio actual es promocional. Si lo comparas con Anthropic, está la comparativa Claude Opus 5.5 vs GPT-5.6 Sol: misma tarifa, distinto coste real.

Si decides quedarte en GPT-5.6, el método para elegir entre sus tres niveles es el mismo que para GPT-6: una misma batería de tareas, un cambio cada vez y el coste medido por tarea aceptada.

Marco en cinco pasos para elegir entre GPT-5.6 Sol, Terra y Luna: entender la tarea, probar gpt-5.6-terra con esfuerzo medium, comprobar calidad y coste, escalar a Sol u optimizar con Luna, y desplegar con una regla de enrutamiento y un canario; a la derecha, métricas y reglas de facturación

Chat Completions, Responses y el esfuerzo de razonamiento

Antes de cambiar de modelo, revisa qué endpoint usa tu código. Según la guía de GPT-6:

  • GPT-6 Sol y GPT-6 Luna admiten function calling en Chat Completions solo con reasoning_effort: "none". Para razonar y llamar herramientas en la misma petición, OpenAI indica usar Responses.
  • GPT-6 Astra funciona en Chat Completions, pero sus llamadas a herramientas requieren Responses.
  • Las herramientas integradas (búsqueda web, búsqueda en archivos, intérprete de código, computer use, MCP) se usan desde Responses.

Si tu agente vive en Chat Completions con herramientas y un esfuerzo distinto de none, la migración de endpoint forma parte del cambio de modelo. La guía Chat Completions vs Responses API: cuál usar y cuándo migrar explica el porqué y los pasos; para leer el campo usage y no facturar dos veces el razonamiento, está Tokens de razonamiento: cómo evitar contarlos dos veces en Gemini, OpenAI y Claude.

Cuánto cuestan los seis modelos con los mismos tokens

Ejemplo con 100.000 tokens de entrada y 10.000 de salida, tarifa Standard, sin caché ni herramientas (100.000 tokens son 0,1 millones y 10.000 son 0,01 millones; cada cantidad se multiplica por su tarifa por millón):

ModeloCálculoCoste
GPT-6 Astra0,1 × 10 + 0,01 × 501,50 $
GPT-6 Sol0,1 × 2 + 0,01 × 100,30 $
GPT-6 Luna0,1 × 0,10 + 0,01 × 0,500,015 $
GPT-5.6 Sol0,1 × 4 + 0,01 × 200,60 $
GPT-5.6 Terra0,1 × 2 + 0,01 × 120,32 $
GPT-5.6 Luna0,1 × 0,20 + 0,01 × 1,200,032 $

Con cargas que generan mucha salida, la ventaja de GPT-6 Sol sobre Terra crece: con 10.000 tokens de entrada y 50.000 de salida, Terra cuesta 0,01 × 2 + 0,05 × 12 = 0,62 $ y GPT-6 Sol, 0,01 × 2 + 0,05 × 10 = 0,52 $.

Estas cifras comparan los mismos tokens, no la misma tarea terminada. Un modelo que razona más, reintenta o escribe respuestas más largas gasta más tokens por tarea. Artificial Analysis lo midió con GPT-6 Luna y GPT-6 Sol en esfuerzo alto: Luna usó unos 20.000 tokens de salida por tarea frente a unos 10.000 de Sol, así que ejecutar su índice costó 48 $ con Luna y 610 $ con Sol, 12,7 veces más, no las 20 veces que marca la tarifa. El análisis completo, con las tarifas de caché y los recargos, está en GPT-6 Luna vs Sol: precio, coste por tarea y cuál elegir.

El salto de los 272.000 tokens

Cuando la entrada supera los 272.000 tokens, toda la petición se factura con la tarifa de contexto largo: el doble en entrada y caché, 1,5 veces en salida. Con exactamente 272.000 tokens se sigue en la tarifa corta. Con 10.000 tokens de salida y sin caché:

  • GPT-6 Astra: 272.000 tokens de entrada cuestan 0,272 × 10 + 0,01 × 50 = 3,22 $; con 280.000, 0,28 × 20 + 0,01 × 75 = 6,35 $. Un 2,9 % más de entrada casi duplica la factura.
  • GPT-6 Sol: de 0,272 × 2 + 0,01 × 10 = 0,644 $ a 0,28 × 4 + 0,01 × 15 = 1,27 $.

Las páginas de OpenAI no aclaran si los tokens en caché cuentan para ese umbral. Si tus peticiones rondan esa cifra, recorta el contexto o parte la tarea antes de comparar modelos.

Batch, Flex y Fast mode

Batch y Flex cuestan el 50 % de la tarifa Standard en los seis modelos; Fast mode (antes llamado Priority) cuesta el doble. La caché de prompts cambia mucho el resultado en cargas con un prefijo largo repetido; el concepto está explicado en OpenAI vs Claude: coste de prompt caching, entrada en caché y punto de equilibrio, aunque sus cifras son de mayo de 2026.

Si quieres probar varios de estos IDs desde un mismo endpoint compatible con OpenAI, laozhang.ai publica para los seis las mismas tarifas principales de entrada, salida y lectura de caché que OpenAI, en dólares, sin descuento. Su página no detalla la escritura en caché, Batch, Flex, residencia de datos ni un SLA, así que no sustituye a un proyecto de OpenAI con residencia en la UE.

Qué pasa con tu modelo antiguo y cuándo

La página de obsolescencias de OpenAI fija dos fechas de apagado en la API para modelos de texto que aún pueden estar en producción. Cada aviso de obsolescencia incluye una fecha de apagado, a partir de la cual el modelo deja de responder en la API. En la última columna tienes la alternativa GPT-6 que tiene sentido probar; no la indica OpenAI.

Dejan de funcionar el 23 de octubre de 2026

Modelo en producciónReemplazo que indica OpenAIAlternativa GPT-6 para probar
gpt-3.5-turbogpt-5.6-terragpt-6-luna o gpt-6-sol
gpt-4, gpt-4-turbo, gpt-4-1106-previewgpt-5.6-solgpt-6-sol
gpt-4o-2024-05-13gpt-5.6-solgpt-6-sol
o1, o3-minigpt-5.6-solgpt-6-sol
o1-progpt-5.6-sol con reasoning.mode: progpt-6-sol o gpt-6-astra en modo pro
gpt-4.1-nanogpt-5.6-lunagpt-6-luna
o4-minigpt-5.6-terragpt-6-sol o gpt-6-luna

Dejan de funcionar el 11 de diciembre de 2026

Modelo en producciónReemplazo que indica OpenAIAlternativa GPT-6 para probar
gpt-5-2025-08-07gpt-5.6-solgpt-6-sol
gpt-5-mini-2025-08-07gpt-5.6-terragpt-6-sol o gpt-6-luna
gpt-5-nano-2025-08-07gpt-5.6-lunagpt-6-luna
gpt-5-pro-2025-10-06, o3-pro-2025-06-10gpt-5.6-sol con reasoning.mode: progpt-6-sol o gpt-6-astra en modo pro
o3-2025-04-16gpt-5.6-solgpt-6-sol

Otras fechas que conviene tener claras:

  • chatgpt-4o-latest salió de la API el 17 de febrero de 2026.
  • A 25 de septiembre de 2026, el alias gpt-4o sin fecha y gpt-4.1 no aparecen en estas listas de apagado; solo la instantánea gpt-4o-2024-05-13 tiene fecha.
  • GPT-4o dejó de estar disponible en ChatGPT el 13 de febrero de 2026. Eso no apagó la API: la nota de ayuda de OpenAI indica que esos modelos seguían disponibles en la API.
  • Ningún modelo GPT-5.6 ni GPT-6 tiene fecha de apagado. Para los modelos de disponibilidad general, OpenAI se compromete a avisar con al menos seis meses de antelación.

Cómo migrar sin mezclar variables

La forma más segura de cambiar de modelo es cambiar una sola cosa cada vez:

  1. Congela todo lo demás: prompt, instrucciones del sistema, herramientas, esquema de salida, conjunto de tareas de aceptación, timeout y política de reintentos.
  2. Mide el estado actual: tasa de aprobación a la primera, correcciones humanas, tokens de entrada, caché, salida y razonamiento, reintentos, latencia P50/P95 y coste por tarea aceptada.
  3. Prueba el reemplazo con el mismo esfuerzo de razonamiento que usas hoy.
  4. Prueba ese mismo modelo con un grado menos de esfuerzo. A veces basta con eso para compensar el cambio de precio.
  5. Cambia de nivel solo si el problema persiste: por ejemplo, de GPT-6 Sol a Astra si falla en calidad, a Luna si sobra calidad y falta margen.

Si tu modelo tiene fecha de apagado, recorre estos pasos a la vez con el reemplazo GPT-5.6 que designa OpenAI y con la alternativa GPT-6. Así tienes un destino validado antes de la fecha y un dato real para decidir si GPT-6 compensa. Pasa el tráfico con un canario pequeño y mantén una ruta de reserva (el modelo actual mientras siga activo; después, el reemplazo GPT-5.6) hasta que el coste por tarea aceptada sea estable.

Hoja de trabajo de migración controlada: plan en cinco pasos desde congelar prompt, herramientas y esquema hasta cambiar de nivel GPT-5.6 solo si persiste el problema, tabla de registro por candidato con tokens, reintentos, latencia y coste por tarea aceptada, y apartados de canario, fallback y disparadores para volver a medir

Qué parámetros cambian al pasar a GPT-6

La guía de GPT-6 enumera estos ajustes:

  • Esfuerzo: conserva el esfuerzo efectivo que usas hoy. Astra no admite none, así que usa low. Si tu petición usa minimal, empieza con low y compara. El parámetro es reasoning.effort en Responses y reasoning_effort en Chat Completions.
  • Parámetros no admitidos: con un esfuerzo distinto de none, quita temperature, top_p y top_logprobs; en Chat Completions, también logprobs.
  • Caché de prompts: si vienes de GPT-5.5 o anterior, sustituye prompt_cache_retention por prompt_cache_options.ttl con el valor "30m".
  • Herramientas: Responses, con las condiciones de la sección anterior.

Una petición mínima de prueba con Responses:

bash
curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-sol",
    "reasoning": {"effort": "medium"},
    "input": "Extrae la fecha de renovación y el plazo de preaviso de este contrato y devuelve JSON: ..."
  }'

Guarda en el registro de cada prueba el ID del modelo que respondió, el esfuerzo, el bloque usage completo y el resultado de tu validación. Sin esos datos no podrás comparar el coste por tarea entre candidatos.

Si tu empresa necesita los datos en la UE

España, México, Argentina y Colombia están en la lista de países donde se ofrece la API. OpenAI advierte que acceder desde fuera de esa lista puede acabar en el bloqueo o la suspensión de la cuenta.

La residencia de datos en Europa es otra cosa y tiene condiciones propias, según la guía de datos de OpenAI:

  • Región: «Europe (EEA + Switzerland)», con el endpoint eu.api.openai.com.
  • Por proyecto: la región se elige al crear un proyecto nuevo dentro de tu organización.
  • Requiere aprobación: fuera de EE. UU. hay que estar aprobado para los controles de supervisión de abusos (abuse monitoring) y firmar una enmienda de retención modificada (Modified Retention). La tabla de regiones lo resume como «Requires MAM or ZDR» y OpenAI remite a su equipo de ventas para comprobar si cumples los requisitos. El plazo de aprobación no está publicado.
  • Recargo del 10 % en los modelos elegibles publicados desde el 5 de marzo de 2026. GPT-6 Astra, Sol y Luna y los tres GPT-5.6 lo son.
  • GPT-6 solo con procesamiento Standard: la guía de datos lo dice de GPT-6 Sol y Luna; la guía de GPT-6 y la página de precios lo extienden a Astra. Cuenta con que ningún GPT-6 tiene Batch ni Flex con residencia en la UE y confírmalo en tu cuenta.

Para GPT-5.6 no aparece esa limitación: la tabla de residencia incluye /v1/batches con GPT-5.6 Sol, Terra y Luna en la región europea. Eso puede invertir la comparación de precios. Con 100.000 tokens de entrada y 10.000 de salida, GPT-6 Sol en Standard cuesta 0,30 $; GPT-5.6 Terra en Batch, 0,1 × 1 + 0,01 × 6 = 0,16 $. Con el recargo del 10 % en ambos, 0,33 $ frente a 0,176 $. Si tu carga tolera la latencia de Batch y necesitas residencia en la UE, Terra puede salir más barato que GPT-6 Sol.

Preguntas frecuentes

¿GPT-6 Sol y GPT-5.6 Sol son el mismo modelo?

No. Son dos modelos de generaciones distintas con el mismo nombre de nivel. gpt-6-sol cuesta 2 $ de entrada y 10 $ de salida por millón de tokens; gpt-5.6-sol, 4 $ y 20 $ (precio promocional). Antes de leer un precio o una prueba de rendimiento, comprueba el ID completo.

¿Qué diferencia hay entre ChatGPT y los modelos Sol, Terra y Luna de la API?

ChatGPT es la aplicación con suscripción; la API se contrata y se factura por separado, por tokens. Tener ChatGPT Plus o Pro no da acceso a la API ni crédito para usarla. En ChatGPT, GPT-6 Sol y Luna llegaron el 22 de septiembre a los planes Plus, Pro, Business, Enterprise y Edu en Work y Codex, y los planes Free y Go tienen Luna en la aplicación de escritorio. Si lo que buscas es qué plan de ChatGPT te conviene, la comparativa ChatGPT Go o Plus: diferencias reales, límites y uso de Codex trata esa decisión.

¿Se apaga GPT-4o en la API?

Solo la instantánea gpt-4o-2024-05-13, el 23 de octubre de 2026, con gpt-5.6-sol como reemplazo oficial. A 25 de septiembre de 2026, el alias gpt-4o sin fecha no figura en las listas de apagado. La retirada de febrero de 2026 afectó a ChatGPT, no a la API.

¿Cuánto cuesta la API de OpenAI por modelo?

Por millón de tokens de entrada y salida, en contexto corto: GPT-6 Astra 10 $ y 50 $, GPT-6 Sol 2 $ y 10 $, GPT-6 Luna 0,10 $ y 0,50 $, GPT-5.6 Sol 4 $ y 20 $, GPT-5.6 Terra 2 $ y 12 $, GPT-5.6 Luna 0,20 $ y 1,20 $. Son precios en dólares sin IVA; la residencia en la UE añade un 10 %, y por encima de 272.000 tokens de entrada se aplica la tarifa de contexto largo.

¿Qué pasará con el precio de GPT-5.6 Sol después de noviembre?

OpenAI solo indica que el precio actual se mantiene al menos hasta el 21 de noviembre de 2026; el siguiente no está publicado. Si tu presupuesto depende de GPT-5.6 Sol, revísalo antes de esa fecha o compara ya con GPT-6 Sol, que cuesta la mitad por token.

¿Encontraste un error o un problema que el artículo no cubre? Envía la URL del artículo y lo que viste a hi@laozhang.ai. Lo revisamos y actualizamos el artículo.