AIFreeAPI Logo

Claude Opus 5.5: precio de la API y qué revisar antes de migrar

A
7 min readDesarrollo de API

Opus 5.5 salió el 22 de septiembre de 2026 y cuesta 4 USD por millón de tokens de entrada y 20 USD por millón de salida en la API de Claude. La tarifa baja un 20 % frente a Opus 5; el ahorro por tarea depende también del consumo y de cómo uses la caché. Antes de cambiar el modelo, revisa cuatro incompatibilidades de la API.

Comparación visual entre Claude Opus 5 y Opus 5.5 con tarifas de API y controles de migración

Claude Opus 5.5 ya existe y se puede seleccionar en la API de Claude con el identificador claude-opus-5-5. Anthropic lo lanzó el 22 de septiembre de 2026. La tarifa estándar es de 4 USD por millón de tokens de entrada y 20 USD por millón de salida. Si vienes de Opus 5, cambiar únicamente el nombre del modelo puede provocar errores HTTP 400 o dejar de mostrar las actualizaciones de progreso de tu agente: revisa los parámetros de razonamiento, la selección de herramientas y el tratamiento de los bloques de respuesta antes de mover tráfico de producción. Estos datos proceden del anuncio de Anthropic, la ficha del modelo y su guía de migración.

Dónde está disponible y qué modelo hay que elegir

La ficha oficial marca Opus 5.5 como activo y enumera la API de Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS. El ID de la API directa es claude-opus-5-5, sin sufijo de fecha; en Bedrock figura anthropic.claude-opus-5-5. Usa el identificador indicado para tu plataforma en lugar de trasladar automáticamente el de la API directa. La publicación de un modelo no confirma que una cuenta, región o proveedor concreto lo tenga habilitado: comprueba el catálogo de tu plataforma y, si recibes un error de acceso, verifica las condiciones de esa cuenta.

También puede utilizarse en Claude y Claude Code. Anthropic anunció un aumento de los límites de uso de cinco horas en Pro, Max, Team y Enterprise por asiento, además de una opción para guardar un restablecimiento de límite en las suscripciones. Eso no equivale a una cifra fija de mensajes para todos ni convierte la suscripción en saldo de API. Para estimar gasto de integración hay que mirar la tarifa de API y el consumo de tokens, no el precio mensual del plan. Fuente: anuncio de Anthropic.

Opus 5.5 conserva una ventana de contexto máxima de un millón de tokens y una salida máxima estándar de 128.000 tokens. El límite de salida de 300.000 tokens pertenece a la Batch API en beta y exige la cabecera correspondiente; no es el límite de una petición estándar. El razonamiento adaptativo está siempre activo y el esfuerzo predeterminado es medium. Son límites y valores de configuración, no una promesa de que cada cuenta pueda enviar una petición de ese tamaño. Fuente: especificaciones oficiales.

Cuánto cuesta Opus 5.5 en la API

La siguiente tabla recoge los precios de lista de la API directa de Claude, en dólares estadounidenses por cada millón de tokens, publicados por Anthropic. Entrada y salida se facturan por separado; las lecturas y escrituras de caché tienen tarifas propias. Una plataforma de terceros, impuestos o servicios adicionales pueden cambiar la factura final. Fuentes: ficha de Opus 5.5 y comparación oficial con Opus 5.

Concepto, por millón de tokensOpus 5.5Opus 5
Entrada estándar4 USD5 USD
Salida estándar20 USD25 USD
Lectura de caché0,20 USD0,50 USD

Por tanto, la entrada y la salida estándar cuestan un 20 % menos por token que en Opus 5. La lectura de caché baja un 60 %. Anthropic presenta además una reducción del 40 % en el coste de tareas típicas con la configuración predeterminada: esa cifra procede de sus pruebas y combina las tarifas con un menor uso de tokens. No es un descuento adicional aplicado a cada solicitud ni una predicción para cualquier carga de trabajo. Fuente: metodología y precios comunicados por Anthropic.

Para comparar sin mezclar precio y eficiencia, supón una tarea con 100.000 tokens de entrada sin caché y 20.000 de salida, idénticos en ambos modelos:

ModeloCálculo con las tarifas estándarImporte ilustrativo
Opus 5.50,1 × 4 USD + 0,02 × 20 USD0,80 USD
Opus 50,1 × 5 USD + 0,02 × 25 USD1,00 USD
Ejemplo de coste con el mismo consumo de tokens en Opus 5 y Opus 5.5
Ejemplo de coste con el mismo consumo de tokens en Opus 5 y Opus 5.5

Este cálculo muestra exactamente el efecto de la tarifa: 0,20 USD menos, o un 20 %, para el mismo número de tokens. No incluye escrituras de caché, herramientas, impuestos ni posibles diferencias en la longitud real de la respuesta. Si tu agente reutiliza mucho contexto, el ahorro puede tener otra composición: por ejemplo, 200.000 tokens de lectura de caché cuestan 0,04 USD en Opus 5.5 y 0,10 USD en Opus 5, sin contar los demás tokens de la petición. Puedes rehacer la estimación con los contadores de uso de tus propias tareas y la tabla oficial de precios.

Hay modalidades que alteran la comparación. La ficha indica un 50 % de descuento en entrada y salida de Batch API respecto a las tarifas estándar. El modo rápido de Opus 5.5 cuesta 8 USD de entrada y 40 USD de salida por millón de tokens; Anthropic anuncia hasta 2,5 veces la velocidad en ese modo, pero la disponibilidad de la vista previa depende de la ruta. No uses sus precios para presupuestar una petición estándar ni presupuestes Batch para un flujo que necesita respuesta inmediata. Fuentes: ficha del modelo y anuncio del modo rápido.

La migración desde Opus 5 exige revisar la petición y la respuesta

Si tu aplicación usa la Messages API, empieza por sustituir claude-opus-5 por claude-opus-5-5 en un entorno de pruebas. A continuación, inspecciona estas cuatro zonas de compatibilidad. La guía de migración de Anthropic describe los errores y las excepciones por plataforma; para Claude Managed Agents indica que basta actualizar el nombre del modelo.

Mapa de las cuatro comprobaciones principales al migrar de Claude Opus 5 a Opus 5.5
Mapa de las cuatro comprobaciones principales al migrar de Claude Opus 5 a Opus 5.5
  1. Parámetro de razonamiento. En Opus 5.5 no se acepta thinking: {"type": "disabled"} ni el formato antiguo thinking: {"type": "enabled", "budget_tokens": N}: ambos devuelven HTTP 400. Quita ese campo y ajusta output_config.effort si necesitas controlar la profundidad del razonamiento. Si no lo defines, el esfuerzo de Opus 5.5 es medium, mientras que en Opus 5 era high; compara calidad, latencia y gasto al nivel que realmente vayas a utilizar.
  2. Selección forzada de herramientas. tool_choice con type: "any" o type: "tool" devuelve HTTP 400, también en el endpoint de recuento de tokens. Cambia a auto; cuando importe la forma de los argumentos, revisa el uso estricto de herramientas o las salidas estructuradas. No presupongas que un prompt sustituye una garantía de ejecución forzada.
  3. Bloques de razonamiento en conversaciones continuadas. Lee los bloques por su type y devuelve los bloques thinking sin modificarlos junto con los resultados de herramientas. Un router que cambie de modelo debe contemplar qué modelos pueden leer esos bloques. Además, editar mensajes anteriores, system o tools durante una conversación puede invalidarlos: la guía señala aplicación estricta por defecto para cuentas creadas desde el 31 de agosto de 2026 a las 00:00 UTC. Una conversación a la que solo se añaden turnos evita esa clase de edición.
  4. Herramienta de ordenador antigua. En la API de Claude y Google Cloud, computer_20251124 deja de aceptarse: hay que declarar computer_toolset_20260801 y adaptar el bucle a los bloques tool_use del conjunto de herramientas. Amazon Bedrock mantiene la herramienta anterior para Opus 5.5; no apliques el cambio de la API directa sin comprobar la compatibilidad de tu plataforma.

Hay un quinto cambio que no provoca un error de petición, pero sí afecta a la interfaz: el texto que aparecía entre llamadas a herramientas en Opus 5 pasa a bloques thinking de actualización de progreso. Con el valor predeterminado de thinking.display, ese texto llega vacío. Si tu producto mostraba esas frases al usuario, puede parecer que el agente se ha quedado callado; revisa display: "updates" —en beta y con su cabecera— o "summarized", y representa los bloques no vacíos según la guía oficial.

El orden práctico es sencillo: prueba una petición sin herramientas, después una con el esquema y tool_choice reales, y finalmente un turno que continúe tras una llamada a herramienta. Confirma que no recibes HTTP 400, que el contenido visible sigue apareciendo y que tu cálculo de coste usa los tokens registrados. Solo entonces compara resultados en tareas tuyas antes de cambiar el tráfico. Este itinerario es una propuesta de comprobación, no una prueba de que una integración concreta ya funcione.

¿Merece la pena cambiar ya?

Si pagas Opus 5 por token y tu integración pasa las pruebas anteriores, Opus 5.5 ofrece una tarifa estándar inferior y merece una evaluación con tus tareas habituales. Si tu presupuesto depende de una reducción fija del 40 %, mide primero tokens y coste por tarea: esa cifra es el resultado comunicado por Anthropic para cargas típicas, no una garantía contractual. Sus resultados publicados de rendimiento tampoco son una prueba independiente de tu repositorio, tus instrucciones o tus salvaguardas. Fuente: anuncio, resultados y notas metodológicas de Anthropic.

Si utilizas Claude Code mediante suscripción, empieza por seleccionar el modelo y observar el límite que muestra tu propia cuenta; no traslades automáticamente los precios por millón de tokens de la API a la cuota del plan. Si mantienes una aplicación con herramientas o conversaciones largas, prioriza la compatibilidad de la guía de migración antes que una comparación de benchmarks. Esa es la diferencia entre saber que el modelo está disponible y saber que tu flujo puede usarlo sin sorpresas.