Claude Opus 5.5 ya existe y se puede seleccionar en la API de Claude con el identificador claude-opus-5-5. Anthropic lo lanzó el 22 de septiembre de 2026. La tarifa estándar es de 4 USD por millón de tokens de entrada y 20 USD por millón de salida. Si vienes de Opus 5, cambiar únicamente el nombre del modelo puede provocar errores HTTP 400 o dejar de mostrar las actualizaciones de progreso de tu agente: revisa los parámetros de razonamiento, la selección de herramientas y el tratamiento de los bloques de respuesta antes de mover tráfico de producción. Estos datos proceden del anuncio de Anthropic, la ficha del modelo y su guía de migración.
Dónde está disponible y qué modelo hay que elegir
La ficha oficial marca Opus 5.5 como activo y enumera la API de Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS. El ID de la API directa es claude-opus-5-5, sin sufijo de fecha; en Bedrock figura anthropic.claude-opus-5-5. Usa el identificador indicado para tu plataforma en lugar de trasladar automáticamente el de la API directa. La publicación de un modelo no confirma que una cuenta, región o proveedor concreto lo tenga habilitado: comprueba el catálogo de tu plataforma y, si recibes un error de acceso, verifica las condiciones de esa cuenta.
También puede utilizarse en Claude y Claude Code. Anthropic anunció un aumento de los límites de uso de cinco horas en Pro, Max, Team y Enterprise por asiento, además de una opción para guardar un restablecimiento de límite en las suscripciones. Eso no equivale a una cifra fija de mensajes para todos ni convierte la suscripción en saldo de API. Para estimar gasto de integración hay que mirar la tarifa de API y el consumo de tokens, no el precio mensual del plan. Fuente: anuncio de Anthropic.
Opus 5.5 conserva una ventana de contexto máxima de un millón de tokens y una salida máxima estándar de 128.000 tokens. El límite de salida de 300.000 tokens pertenece a la Batch API en beta y exige la cabecera correspondiente; no es el límite de una petición estándar. El razonamiento adaptativo está siempre activo y el esfuerzo predeterminado es medium. Son límites y valores de configuración, no una promesa de que cada cuenta pueda enviar una petición de ese tamaño. Fuente: especificaciones oficiales.
Cuánto cuesta Opus 5.5 en la API
La siguiente tabla recoge los precios de lista de la API directa de Claude, en dólares estadounidenses por cada millón de tokens, publicados por Anthropic. Entrada y salida se facturan por separado; las lecturas y escrituras de caché tienen tarifas propias. Una plataforma de terceros, impuestos o servicios adicionales pueden cambiar la factura final. Fuentes: ficha de Opus 5.5 y comparación oficial con Opus 5.
| Concepto, por millón de tokens | Opus 5.5 | Opus 5 |
|---|---|---|
| Entrada estándar | 4 USD | 5 USD |
| Salida estándar | 20 USD | 25 USD |
| Lectura de caché | 0,20 USD | 0,50 USD |
Por tanto, la entrada y la salida estándar cuestan un 20 % menos por token que en Opus 5. La lectura de caché baja un 60 %. Anthropic presenta además una reducción del 40 % en el coste de tareas típicas con la configuración predeterminada: esa cifra procede de sus pruebas y combina las tarifas con un menor uso de tokens. No es un descuento adicional aplicado a cada solicitud ni una predicción para cualquier carga de trabajo. Fuente: metodología y precios comunicados por Anthropic.
Para comparar sin mezclar precio y eficiencia, supón una tarea con 100.000 tokens de entrada sin caché y 20.000 de salida, idénticos en ambos modelos:
| Modelo | Cálculo con las tarifas estándar | Importe ilustrativo |
|---|---|---|
| Opus 5.5 | 0,1 × 4 USD + 0,02 × 20 USD | 0,80 USD |
| Opus 5 | 0,1 × 5 USD + 0,02 × 25 USD | 1,00 USD |

Este cálculo muestra exactamente el efecto de la tarifa: 0,20 USD menos, o un 20 %, para el mismo número de tokens. No incluye escrituras de caché, herramientas, impuestos ni posibles diferencias en la longitud real de la respuesta. Si tu agente reutiliza mucho contexto, el ahorro puede tener otra composición: por ejemplo, 200.000 tokens de lectura de caché cuestan 0,04 USD en Opus 5.5 y 0,10 USD en Opus 5, sin contar los demás tokens de la petición. Puedes rehacer la estimación con los contadores de uso de tus propias tareas y la tabla oficial de precios.
Hay modalidades que alteran la comparación. La ficha indica un 50 % de descuento en entrada y salida de Batch API respecto a las tarifas estándar. El modo rápido de Opus 5.5 cuesta 8 USD de entrada y 40 USD de salida por millón de tokens; Anthropic anuncia hasta 2,5 veces la velocidad en ese modo, pero la disponibilidad de la vista previa depende de la ruta. No uses sus precios para presupuestar una petición estándar ni presupuestes Batch para un flujo que necesita respuesta inmediata. Fuentes: ficha del modelo y anuncio del modo rápido.
La migración desde Opus 5 exige revisar la petición y la respuesta
Si tu aplicación usa la Messages API, empieza por sustituir claude-opus-5 por claude-opus-5-5 en un entorno de pruebas. A continuación, inspecciona estas cuatro zonas de compatibilidad. La guía de migración de Anthropic describe los errores y las excepciones por plataforma; para Claude Managed Agents indica que basta actualizar el nombre del modelo.

- Parámetro de razonamiento. En Opus 5.5 no se acepta
thinking: {"type": "disabled"}ni el formato antiguothinking: {"type": "enabled", "budget_tokens": N}: ambos devuelven HTTP 400. Quita ese campo y ajustaoutput_config.effortsi necesitas controlar la profundidad del razonamiento. Si no lo defines, el esfuerzo de Opus 5.5 esmedium, mientras que en Opus 5 erahigh; compara calidad, latencia y gasto al nivel que realmente vayas a utilizar. - Selección forzada de herramientas.
tool_choicecontype: "any"otype: "tool"devuelve HTTP 400, también en el endpoint de recuento de tokens. Cambia aauto; cuando importe la forma de los argumentos, revisa el uso estricto de herramientas o las salidas estructuradas. No presupongas que un prompt sustituye una garantía de ejecución forzada. - Bloques de razonamiento en conversaciones continuadas. Lee los bloques por su
typey devuelve los bloquesthinkingsin modificarlos junto con los resultados de herramientas. Un router que cambie de modelo debe contemplar qué modelos pueden leer esos bloques. Además, editar mensajes anteriores,systemotoolsdurante una conversación puede invalidarlos: la guía señala aplicación estricta por defecto para cuentas creadas desde el 31 de agosto de 2026 a las 00:00 UTC. Una conversación a la que solo se añaden turnos evita esa clase de edición. - Herramienta de ordenador antigua. En la API de Claude y Google Cloud,
computer_20251124deja de aceptarse: hay que declararcomputer_toolset_20260801y adaptar el bucle a los bloquestool_usedel conjunto de herramientas. Amazon Bedrock mantiene la herramienta anterior para Opus 5.5; no apliques el cambio de la API directa sin comprobar la compatibilidad de tu plataforma.
Hay un quinto cambio que no provoca un error de petición, pero sí afecta a la interfaz: el texto que aparecía entre llamadas a herramientas en Opus 5 pasa a bloques thinking de actualización de progreso. Con el valor predeterminado de thinking.display, ese texto llega vacío. Si tu producto mostraba esas frases al usuario, puede parecer que el agente se ha quedado callado; revisa display: "updates" —en beta y con su cabecera— o "summarized", y representa los bloques no vacíos según la guía oficial.
El orden práctico es sencillo: prueba una petición sin herramientas, después una con el esquema y tool_choice reales, y finalmente un turno que continúe tras una llamada a herramienta. Confirma que no recibes HTTP 400, que el contenido visible sigue apareciendo y que tu cálculo de coste usa los tokens registrados. Solo entonces compara resultados en tareas tuyas antes de cambiar el tráfico. Este itinerario es una propuesta de comprobación, no una prueba de que una integración concreta ya funcione.
¿Merece la pena cambiar ya?
Si pagas Opus 5 por token y tu integración pasa las pruebas anteriores, Opus 5.5 ofrece una tarifa estándar inferior y merece una evaluación con tus tareas habituales. Si tu presupuesto depende de una reducción fija del 40 %, mide primero tokens y coste por tarea: esa cifra es el resultado comunicado por Anthropic para cargas típicas, no una garantía contractual. Sus resultados publicados de rendimiento tampoco son una prueba independiente de tu repositorio, tus instrucciones o tus salvaguardas. Fuente: anuncio, resultados y notas metodológicas de Anthropic.
Si utilizas Claude Code mediante suscripción, empieza por seleccionar el modelo y observar el límite que muestra tu propia cuenta; no traslades automáticamente los precios por millón de tokens de la API a la cuota del plan. Si mantienes una aplicación con herramientas o conversaciones largas, prioriza la compatibilidad de la guía de migración antes que una comparación de benchmarks. Esa es la diferencia entre saber que el modelo está disponible y saber que tu flujo puede usarlo sin sorpresas.



