Saltar al contenido

Claude Opus 5.5 o Fable 5.1: cuál elegir y cuánto cuesta en la API

Empieza por Opus 5.5 para trabajos difíciles: a igual consumo cuesta menos que Fable 5.1 incluso al leer caché. Prueba Fable cuando una evaluación propia justifique el sobrecoste.

A
•••7 min de lectura•Comparación de modelos de IA
Comparación de Claude Opus 5.5 y Fable 5.1 para decidir según el trabajo y el coste

Si utilizas la API directa de Claude, empieza la comparación con Opus 5.5. Su tarifa estándar es inferior a la de Fable 5.1 para entrada, salida, escritura y lectura de caché. Fable sigue mereciendo una prueba en razonamiento especialmente exigente o agentes que trabajan durante horas, pero tendrá que resolver más tareas, necesitar menos intentos o ahorrar suficiente revisión para compensar su precio. No hay un umbral de lecturas de caché que, por sí solo, le dé la vuelta a la factura con el mismo consumo de tokens.

Esta elección afecta al coste por tarea aceptada, no solo al precio por millón de tokens. También depende del nivel de effort: en la API, Opus 5.5 empieza en medium y Fable 5.1 en high, según las fichas oficiales de Opus 5.5 y Fable 5.1. Antes de atribuir una diferencia al modelo, deja constancia del nivel usado en cada prueba.

Cuánto cuesta Opus 5.5 frente a Fable 5.1

La tarifa de Anthropic para la API directa, consultada el 23 de septiembre de 2026, expresa estos importes en dólares por un millón de tokens. Son precios estándar; no incluyen herramientas adicionales, impuestos, modo Fast, Batch ni precios propios de plataformas asociadas.

Tipo de tokenOpus 5.5Fable 5.1
Entrada nueva4 $10 $
Salida20 $50 $
Escritura de caché, 5 minutos5 $12,50 $
Escritura de caché, 1 hora8 $20 $
Lectura de caché0,20 $0,25 $

Con la misma cantidad de cada clase de tokens, Opus 5.5 cuesta menos en todas las filas. Sus tarifas de entrada nueva, salida y escritura equivalen al 40 % de las de Fable; la lectura de caché equivale al 80 %. Por eso ya no sirve la regla anterior de que Fable 5.1 podía ganar a Opus 5 cuando se releía muchas veces el mismo contexto: aquella comparación utilizaba los 0,50 $ por millón de lecturas de Opus 5, no los 0,20 $ de Opus 5.5.

Infografía de las tarifas de entrada, salida y caché de Opus 5.5 y Fable 5.1 por millón de tokens

Por ejemplo, supón 100.000 tokens de entrada nueva, 20.000 de salida y 200.000 lecturas de caché, sin nuevas escrituras ni otros cargos. El cálculo con la tarifa publicada es:

  • Opus 5.5: 0,1 × 4 + 0,02 × 20 + 0,2 × 0,20 = 0,84 $.
  • Fable 5.1: 0,1 × 10 + 0,02 × 50 + 0,2 × 0,25 = 2,05 $.

Es un ejemplo con consumo idéntico, no una medición de ambos modelos en una tarea real. Si uno genera más tokens, hace más llamadas o necesita varios intentos, la diferencia efectiva cambia. La caché tampoco es gratuita: su escritura se factura aparte y su utilidad depende de que las peticiones posteriores reutilicen el prefijo.

¿Es Opus 5.5 tan capaz como Fable 5.1?

Anthropic presenta a Opus 5.5 como comparable a Fable 5.1 en gran parte del trabajo y publica resultados favorables a Opus en varias pruebas. En su anuncio de Opus 5.5, por ejemplo, comunica un 66,4 % frente a un 55,8 % en Terminal-Bench 4.0 y un 57,8 % frente a un 51,8 % en CursorBench 4.0. Son resultados del proveedor para versiones y configuraciones concretas, no una garantía para tu repositorio o tus documentos.

El ajuste de esfuerzo cambia la lectura de esas cifras. Salvo las excepciones que detalla Anthropic, los resultados publicados de Opus 5.5 utilizan max; Terminal-Bench 4.0 se informa con xhigh. El valor predeterminado de Opus 5.5 en la API es medium. No conviene trasladar una puntuación obtenida con esfuerzo alto a una estimación de coste calculada con el ajuste predeterminado como si fueran la misma ejecución. Anthropic también advierte que las diferencias pequeñas entre modelos muy capaces pueden no reflejar lo que se percibe en el uso real.

El otro porcentaje fácil de confundir es el 40 % menos de coste típico que anuncia Anthropic para Opus 5.5: su referencia es Opus 5, a los ajustes predeterminados, no Fable 5.1. La tabla anterior permite comparar el precio de Opus 5.5 y Fable 5.1 por token; una reducción concreta del coste por trabajo entre ambos exige medir el consumo y el resultado del mismo flujo.

Cuándo probar Fable 5.1 y cómo decidirlo

La guía oficial para elegir modelo propone Opus 5.5 como punto de partida para programación agéntica compleja y trabajo empresarial; sitúa Fable 5.1 en tareas de máxima exigencia, como sesiones de agentes de varias horas o investigación en varios pasos. Eso orienta la primera prueba, pero la decisión para producción debe salir de tus propios criterios de aceptación.

Prepara un conjunto pequeño de trabajos representativos: tareas corrientes, tareas largas y fallos que resultarían caros. Define antes qué cuenta como éxito: tests que pasan, cifras conciliadas con sus fuentes, un documento revisable o una operación terminada sin intervención. Ejecuta Opus 5.5 y Fable 5.1 con la misma entrada, herramientas, permisos, límite de tiempo y regla de parada. Anota el effort de cada ejecución y prueba primero Opus con un nivel mayor si medium falla en trabajos importantes.

Registro por tareaPor qué importa
Entrada nueva, salida, escrituras y lecturas de cachéPermite aplicar la tarifa real a cada ejecución.
Éxito inicial, reintentos y fallo definitivoUn modelo barato por token puede necesitar más intentos.
Tiempo hasta un resultado aceptadoUna respuesta rápida que requiere reparaciones puede tardar más en conjunto.
Revisión y correcciones humanasSon parte del trabajo necesario para entregar el resultado.
Diagrama para evaluar ambos modelos con la misma tarea y criterio, contando reintentos, herramientas y revisión

Calcula coste por tarea aceptada = (API de todos los intentos + herramientas + tiempo humano valorado) ÷ tareas aceptadas. Si no dispones de una valoración monetaria fiable del tiempo humano, informa por separado del gasto de API y de los minutos de revisión por tarea aceptada. Si Opus supera las pruebas al nivel de esfuerzo elegido, no hay una ventaja de tarifa de caché que obligue a pasar a Fable. Si Fable resuelve fallos persistentes o reduce suficiente trabajo posterior, resérvalo para ese grupo concreto de tareas.

Ambos modelos ofrecen un contexto de un millón de tokens y una salida máxima estándar de 128.000 tokens en sus fichas de la API. Esas cifras no significan que cada tarea deba llenar el contexto ni que vaya a producir la salida máxima. Tampoco convierten el precio de la API en una cuota de mensajes de Claude Pro o Max.

Sonnet 5 y Haiku 4.5 siguen teniendo sitio

Antes de pagar por cualquiera de los dos modelos más caros, comprueba si el trabajo requiere esa capacidad. La guía de selección de Anthropic sitúa Sonnet 5 en el trabajo diario y Haiku 4.5 en flujos donde importan la rapidez y el volumen. La misma tabla de precios permite fijar un punto de partida económico:

ModeloID en la APIEntrada / salida estándar, USD por millónPrimera prueba razonable
Haiku 4.5claude-haiku-4-5-202510011 $ / 5 $Clasificación o extracción masiva con fallos fáciles de detectar.
Sonnet 5claude-sonnet-52 $ / 10 $Código, análisis y herramientas del trabajo habitual.
Opus 5.5claude-opus-5-54 $ / 20 $Tareas complejas que Sonnet no supera con fiabilidad.
Fable 5.1claude-fable-5-110 $ / 50 $Casos límite que siguen fallando con Opus tras ajustar el esfuerzo.

La secuencia práctica es probar primero el modelo más económico que pueda cumplir tus criterios y subir cuando aparezca un fallo reproducible. Si ya tienes un agente difícil en Opus 5 o Fable 5.1, compara de nuevo contra Opus 5.5: las antiguas cuentas de caché y los resultados de otro modelo no deciden este cambio. Para detalles de integración, consulta las fichas de Opus 5.5 y Fable 5.1.

Antes de cambiar tráfico en producción

Anota el modelo exacto, el effort, max_tokens, los aciertos de caché y el coste de herramientas de cada prueba. Revisa también las llamadas a herramientas y las denegaciones: la guía de migración de Opus 5.5 recoge cambios de comportamiento que pueden afectar a una integración existente. Amplía el tráfico por etapas y conserva una forma de volver al modelo anterior si el porcentaje de tareas aceptadas empeora.

Los importes de este artículo corresponden a peticiones estándar de la API directa. Batch, Fast, la residencia de datos y las plataformas asociadas pueden tener otras tarifas o condiciones; usa la tabla del canal que realmente te factura antes de presupuestar. La recomendación de partida sigue siendo Opus 5.5 para un trabajo difícil y Fable 5.1 solo para las tareas en las que su resultado medido compense el sobrecoste completo.