AIFreeAPI Logo

Cuánto cuesta generar una imagen con GPT Image 2 por API

A
10 min readGeneración de imágenes con IA

Una imagen de 1024 × 1024 en calidad media tiene una salida estimada de 0,053 USD. Para presupuestar tu aplicación, añade las entradas, las ediciones y las variantes que finalmente descartes.

Ilustración de portada de la guía de costes de GPT Image 2

GPT Image 2 tiene un coste de salida estimado de 0,006, 0,053 o 0,211 USD para una imagen de 1024 × 1024, según elijas calidad baja, media o alta. A esa cifra se suma el texto de entrada y, si editas o aportas referencias, el consumo de las imágenes de entrada. No es una tarifa fija que incluya toda la solicitud.

Los importes de esta guía corresponden a la API directa de OpenAI y a las tarifas consultadas el 6 de septiembre de 2026. Están expresados en dólares estadounidenses; no son precios finales en euros con IVA. Si contratas a través de otro proveedor, utiliza su tarifa y sus condiciones de facturación.

La tabla que necesitas antes de hacer números

La guía oficial de generación de imágenes publica estas estimaciones para GPT Image 2, modalidad Standard, solo salida:

Tamaño solicitadoBaja (low)Media (medium)Alta (high)
1024 × 10240,006 USD0,053 USD0,211 USD
1024 × 15360,005 USD0,041 USD0,165 USD
1536 × 10240,005 USD0,041 USD0,165 USD

Son estimaciones redondeadas para esas combinaciones concretas. No representan un mínimo y un máximo universales, ni incluyen las entradas.

La diferencia entre formatos es relevante: una salida rectangular puede costar menos que una cuadrada, aunque tenga más píxeles. Con GPT Image 2 no puedes obtener un presupuesto fiable multiplicando el precio por la superficie de la imagen. Tampoco debes aplicar la antigua tabla de 272, 1056 y 4160 tokens de salida: la documentación la reserva para modelos anteriores.

Para otra resolución, introduce el modelo, el tamaño exacto y la calidad en la calculadora de esa misma guía. Una petición de 3840 × 2160 requiere su propia estimación; no se deduce multiplicando la fila de 1024 × 1024. La documentación admite tamaños como 3840 × 2160 y 2160 × 3840, con un máximo de 3840 píxeles por lado y 8 294 400 píxeles en total; los tamaños superiores a 2K figuran como experimentales. «4K» por sí solo no identifica una combinación de dimensiones y calidad ni un precio.

Ilustración sobre los costes de generación de imágenes con GPT Image 2
Ilustración sobre los costes de generación de imágenes con GPT Image 2

De una imagen a un presupuesto mensual

Supón que una tienda quiere generar 2400 imágenes de 1536 × 1024 al mes, con calidad media y una única salida por solicitud. Para una primera previsión:

  • Salida estimada: 2400 × 0,041 = 98,40 USD.
  • Texto de entrada supuesto: 500 tokens por solicitud, sin caché.
  • Coste de ese texto: 2400 × 500 × 5 / 1 000 000 = 6 USD.
  • Total orientativo: 104,40 USD, es decir, 0,0435 USD por solicitud.

El ejemplo supone generación a partir de texto mediante la API de imágenes, sin referencias, ediciones, imágenes parciales ni llamadas adicionales a un modelo conversacional. Los 500 tokens son un supuesto para hacer el cálculo, no una equivalencia entre palabras y tokens ni un consumo medido.

Si las mismas 2400 solicitudes se hacen en calidad alta, la salida estimada pasa a 396 USD y el total, con idéntica entrada de texto, a 402 USD. La elección de calidad cambia aquí mucho más el presupuesto que acortar unas palabras de la instrucción.

Pero 2400 salidas no equivalen necesariamente a 2400 imágenes aprovechables. Si necesitas un volumen de entregas concretas, calcula primero cuántas variantes y ediciones suele requerir cada entrega. Esa relación se obtiene de tus propios resultados, no de la tabla de precios.

Cómo calcular una solicitud completa, incluidas las ediciones

OpenAI factura GPT Image 2 por categorías de tokens. Estas son las tarifas oficiales de generación de imágenes, en USD por un millón de tokens:

CategoríaStandardBatch
Texto de entrada sin caché52,50
Texto de entrada recuperado de caché1,250,625
Imagen de entrada sin caché84
Imagen de entrada recuperada de caché21
Imagen de salida3015

Para calcular el importe, multiplica los tokens de cada categoría por su tarifa, suma los resultados y divide entre un millón. Cada token de entrada debe aparecer una sola vez: a precio normal o a precio de caché. Repetir una imagen o una instrucción no basta para dar por hecho que hubo un acierto de caché.

La tarifa de salida de texto de 10 USD que aparece para GPT Image 1.5 no se debe trasladar a GPT Image 2: su fila muestra un guion en esa columna. Si utilizas Responses con la herramienta de imágenes, contabiliza por separado los tokens del modelo principal que la invoca, según su propia tarifa.

Un ejemplo de edición con consumo desglosado

Imagina una solicitud cuyo consumo se ha clasificado así. Son cantidades ficticias para practicar el cálculo, sin atribuirlas a una resolución ni a un número concreto de referencias:

ConceptoTokens supuestosCálculo StandardImporte
Texto sin caché900900 × 5 / 1 000 0000,0045 USD
Texto con caché300300 × 1,25 / 1 000 0000,000375 USD
Imagen de entrada sin caché18001800 × 8 / 1 000 0000,0144 USD
Imagen de entrada con caché600600 × 2 / 1 000 0000,0012 USD
Imagen de salida16001600 × 30 / 1 000 0000,048 USD
Total0,068475 USD

Aquí el texto de entrada suma 1200 tokens y la imagen de entrada, 2400. Los tokens recuperados de caché ya forman parte de esos totales. Si tu registro presenta un total de entrada y su subconjunto en caché, resta ese subconjunto antes de aplicar la tarifa sin caché.

Puedes reproducir el cálculo con Python. Las variables son categorías de una hoja de cálculo, no nombres de campos de una respuesta de la API; debes rellenarlas con el desglose que realmente proporcione tu integración:

python
from decimal import Decimal # Ejemplo ficticio: categorías mutuamente excluyentes. tokens = { "texto_sin_cache": 900, "texto_cache": 300, "imagen_sin_cache": 1800, "imagen_cache": 600, "imagen_salida": 1600, } tarifas = { "texto_sin_cache": "5", "texto_cache": "1.25", "imagen_sin_cache": "8", "imagen_cache": "2", "imagen_salida": "30", } importe = sum( Decimal(tokens[categoria]) * Decimal(tarifas[categoria]) for categoria in tokens ) / Decimal(1_000_000) print(importe) # 0.068475 USD, Standard

GPT Image 2 procesa las imágenes de entrada siempre con alta fidelidad. No existe un precio universal por referencia ni un multiplicador fijo para «editar una imagen». Añadir referencias puede aumentar el consumo de entrada; no intentes reducirlo configurando input_fidelity, porque este modelo no permite cambiarlo y debe omitirse.

Si activas imágenes parciales durante la generación, cada una añade 100 tokens de salida de imagen, equivalentes a 0,003 USD en Standard. Es el suplemento por imagen parcial, no el precio de la imagen final. Al conciliar el consumo, no vuelvas a sumarlo si esos tokens ya están incluidos en el total registrado. La regla está documentada en el coste de las imágenes parciales.

Lo que cuesta una imagen que sí vas a utilizar

Para valorar si una configuración es económica, utiliza esta relación:

text
Coste por imagen aceptada = gasto facturado de la tarea / número de imágenes aceptadas

El numerador incluye las generaciones y ediciones cobradas que se descartaron. El denominador cuenta las imágenes que cumplen los requisitos de entrega; no cuenta cada vista previa como otro resultado útil.

Siguiendo el ejemplo ficticio anterior, 1200 solicitudes a 0,068475 USD suman 82,17 USD. Si se aceptan 900 imágenes, el coste por imagen aceptada es 0,0913 USD. La cifra de 0,048 USD de la salida, la de 0,068475 USD de la solicitud y la de 0,0913 USD del resultado aceptado responden a preguntas distintas.

Para trasladarlo a tu aplicación, guarda junto a cada tarea el identificador de solicitud, modelo, fecha, tamaño, calidad, modalidad, desglose de consumo, importe facturado y decisión de aceptación. Une las variantes y ediciones a la tarea original, evitando duplicar una misma solicitud en la suma.

Cuando el resultado no llega, contrasta entrega y facturación por separado. Un HTTP 200 no demuestra por sí solo que hayas obtenido una imagen utilizable; un error HTTP tampoco demuestra que exista un cargo. La previsión debe corregirse con los importes realmente facturados, las imágenes recibidas y las que acabaste aceptando.

Ilustración complementaria de la guía de precios de GPT Image 2
Ilustración complementaria de la guía de precios de GPT Image 2

Cuándo compensa Batch

Batch reduce a la mitad las tarifas por token de GPT Image 2, pero implica procesamiento asíncrono. La documentación de Batch admite actualmente /v1/images/generations y /v1/images/edits, con una ventana de procesamiento de 24 horas.

Para el mismo consumo del ejemplo de edición, el cálculo con las tarifas Batch da 0,0342375 USD. No es un descuento que puedas aplicar a una solicitud Standard añadiendo una nota al presupuesto: debes enviar un lote válido mediante la API correspondiente.

Tiene sentido para renovar imágenes de un catálogo con antelación o preparar recursos que no se necesitan al instante. Si la persona está esperando una imagen dentro de tu aplicación, presupuesta la modalidad síncrona que vayas a utilizar. Tampoco atribuyas un ahorro a la caché hasta que el consumo confirme que se ha aplicado.

Cómo queda la comparación con GPT Image 1.5 y Mini

GPT Image 2 es el modelo actual de referencia para generación y edición de imágenes de OpenAI. GPT Image 1.5 sigue siendo útil en una comparación económica, pero ya no debe presentarse como el más reciente.

Estas son estimaciones oficiales de salida por imagen, Standard, 1024 × 1024, con entradas aparte:

ModeloBajaMediaAlta
GPT Image 20,006 USD0,053 USD0,211 USD
GPT Image 1.50,009 USD0,034 USD0,133 USD
GPT Image 1 Mini0,005 USD0,011 USD0,036 USD
GPT Image 10,011 USD0,042 USD0,167 USD

Mini tiene las salidas cuadradas más baratas de esta comparación, pero eso no garantiza el menor coste por imagen aceptada en tu trabajo. Utiliza las mismas instrucciones, materiales y criterios de aceptación al comparar tus resultados, y suma también las ediciones necesarias.

La comparación cambia con el formato. En 1536 × 1024 o 1024 × 1536, la salida de GPT Image 1.5 cuesta aproximadamente 0,013 / 0,050 / 0,200 USD en baja / media / alta; la de Mini, 0,006 / 0,015 / 0,052 USD; y la de GPT Image 1, 0,016 / 0,063 / 0,250 USD. En esos tamaños, GPT Image 2 tiene una salida estimada inferior a GPT Image 1.5 en las tres calidades. Todos estos valores proceden de la comparación oficial por tamaño.

El alias chatgpt-image-latest tiene, en la tabla de tarifas consultada, los mismos precios por token que GPT Image 1.5. No debe interpretarse como un precio permanente del alias ni como la tarifa de GPT Image 2. Para que tus comparaciones futuras sean útiles, registra el identificador del modelo empleado y la fecha del consumo.

Dudas al contratar o integrar

¿Mi suscripción de ChatGPT incluye las llamadas a esta API?

La facturación de ChatGPT y la plataforma API es independiente. Presupuesta el uso de la API por separado, aunque ya pagues una suscripción de ChatGPT.

¿Puedo usar estos importes si contrato un intermediario?

Solo como referencia para comparar. Comprueba qué modelo ofrece, si cobra por tokens o por llamada, qué incluye cada precio y cómo factura ediciones, errores y devoluciones. Una tarifa fija de un proveedor no es la tarifa oficial de la API directa de OpenAI.

¿Cómo obtengo una previsión en euros?

Calcula primero el consumo en USD. Después aplica el tipo de cambio, las comisiones y los impuestos que correspondan a tu forma de pago y a la factura del proveedor. No cambies el símbolo de moneda conservando la cifra.

Para empezar la integración, continúa con la guía de la API de GPT Image 2. Si ya generas imágenes, el siguiente paso para afinar tu presupuesto es sustituir los supuestos de los ejemplos por el consumo de tus propias tareas y su proporción de imágenes aceptadas.