AIFreeAPI Logo

Fable 5.1 o Opus 5: cuánto cuesta de verdad y cuándo compensa la caché

A
6 min readComparación de modelos de IA

Opus 5 cuesta la mitad en entrada nueva, salida y escritura de caché; Fable 5.1 cuesta la mitad al leerla. La mezcla de tokens y la tasa de éxito deciden la factura.

Comparación de Fable 5.1 y Opus 5 con tarifas de Claude API, umbral de caché, resultado de Devin, gama de modelos y coste por tarea aceptada

Opus 5 es la opción económica por defecto. En la tarifa estándar de Claude API cuesta la mitad que Fable 5.1 en entrada nueva, salida y escritura de caché. La única partida que se invierte es la lectura de caché: $0,25 por millón de tokens en Fable 5.1 frente a $0,50 en Opus 5.

Esa excepción puede cambiar el coste de un agente que relee durante horas un contexto casi idéntico. No suele cambiarlo en una consulta breve, una tarea con pocos aciertos de caché o un trabajo que Opus termina bien a la primera. Para decidir hay que separar dos magnitudes: el precio de la misma cantidad de tokens y el coste de conseguir una tarea que cumpla los criterios de aceptación.

A 4 de septiembre de 2026, la comparativa oficial de modelos recomienda empezar con Opus 5 en la mayoría de cargas. Anthropic reserva Fable 5.1 para razonamiento exigente, agentes de larga duración y casos en los que Opus 5 con un effort mayor sigue sin superar la evaluación.

Una sola partida favorece a Fable 5.1

La tabla vigente de Claude API separa cinco clases de tokens:

USD por millón de tokensFable 5.1Opus 5Tarifa menor
Entrada nueva$10$5Opus 5
Salida$50$25Opus 5
Escritura de caché, 5 minutos$12,50$6,25Opus 5
Escritura de caché, 1 hora$20$10Opus 5
Lectura de caché$0,25$0,50Fable 5.1
Batch: entrada / salida$5 / $25$2,50 / $12,50Opus 5

El precio de lectura solo sirve si el prefijo se reutiliza de verdad. Según la documentación de prompt caching, primero se escribe un prefijo estable y las peticiones posteriores lo leen mientras coincida y siga vigente. La duración predeterminada es de cinco minutos; la opción de una hora encarece la escritura. Cambiar tools, system o el principio de messages puede reducir la tasa de aciertos que se había supuesto.

Tampoco conviene mezclar el modo estándar con Opus 5 fast mode. Esta research preview cobra $10/$50 por una latencia menor, no sustituye la tarifa normal de $5/$25 y no se combina con Batch.

El punto de equilibrio se puede despejar

Supongamos que los dos modelos consumen exactamente la misma cantidad de cada tipo de token. Todas las variables se expresan en millones:

  • I: entrada nueva;
  • O: salida;
  • W5: escritura de caché de cinco minutos;
  • W1: escritura de caché de una hora;
  • C: lectura de caché.

Las facturas de tokens son:

Fable = 10I + 50O + 12.5W5 + 20W1 + 0.25C

Opus = 5I + 25O + 6.25W5 + 10W1 + 0.50C

Al comparar ambas, Fable solo resulta más barato cuando:

C > 20I + 100O + 25W5 + 40W1

Un ejemplo permite ver lo alto que es el umbral. Con 100.000 tokens de entrada nueva, 20.000 de salida y ninguna escritura nueva de caché, se necesitan más de cuatro millones de tokens leídos desde caché. Con 1,5 millones, Fable cuesta unos $2,38 y Opus $1,75. Con seis millones, la relación se invierte: aproximadamente $3,50 frente a $4.

Si la primera petición crea una entrada de caché, el umbral sube. Por eso el primer turno puede favorecer a Opus y una secuencia larga de reutilización favorecer después a Fable. La ecuación verifica la lista de precios manteniendo los volúmenes iguales; no predice cuántos tokens, llamadas de herramienta o reintentos utilizará cada modelo.

Guía para elegir Fable 5.1 u Opus 5 según la reutilización de contexto, el umbral teórico y las métricas del coste por tarea aceptada
Guía para elegir Fable 5.1 u Opus 5 según la reutilización de contexto, el umbral teórico y las métricas del coste por tarea aceptada

Por qué Devin publicó un resultado contrario a la tarifa

Cognition informa en Fable 5.1 dentro de Devin de un coste medio de $2,68 por tarea para Fable 5.1 y $3,51 para Opus 5 en FrontierCode 1.1 Extended, con thinking level medium. Según su informe, Fable utilizó un 33% menos de tokens. Más del 95% de los tokens de ambos modelos fueron lecturas de caché; una tarea típica leyó unos tres millones con Fable y 4,5 millones con Opus.

Las dos condiciones favorecen a Fable: la mayor parte de la factura cae en la única clase donde tiene la tarifa menor y, además, consume menos tokens en esa configuración. El resultado no contradice que Opus sea más barato por entrada y salida.

Sí tiene un límite claro. Las tareas de FrontierCode, las herramientas y la caché de Devin, el nivel medium y los criterios de aceptación de Cognition forman parte de la medición. Es un dato del proveedor en un producto concreto, no una promesa aplicable a cualquier repositorio, análisis documental o sistema de atención.

El anuncio de Anthropic utiliza otros porcentajes y otro comparador. En la presentación de Fable 5.1, la empresa estima alrededor de un 25% menos de coste en cargas típicas y hasta cerca de un 45% en tareas intensivas con agentes, pero frente a Fable 5. El cálculo se basa en cuatro semanas de uso real de agosto de 2026 con el parámetro effort predeterminado; no es un descuento respecto a Opus 5.

Sonnet y Haiku evitan un duelo innecesariamente caro

Antes de probar las dos opciones superiores, comprueba si la tarea necesita esa capacidad.

ModeloID de Claude APIEntrada / salidaContexto / salida máximaTrabajo inicial razonable
Haiku 4.5claude-haiku-4-5-20251001$1 / $5200K / 64Kvolumen alto, poca latencia y control automático
Sonnet 5claude-sonnet-5$2 / $101M / 128Kcódigo, análisis, contenido y tools cotidianos
Opus 5claude-opus-5$5 / $251M / 128Kingeniería compleja, agentes largos y errores caros
Fable 5.1claude-fable-5-1$10 / $501M / 128Ktareas límite que Opus no consigue aceptar

Una transformación masiva con schema y fallos fáciles de detectar puede resolverse comparando Haiku con Sonnet. El trabajo profesional habitual suele necesitar una prueba entre Sonnet y Opus. Reserva el duelo Opus-Fable para la parte larga o difícil donde haya aparecido una limitación reproducible.

Estas cifras pertenecen a la API directa en dólares. No indican cuántos mensajes incluye Claude Pro o Max, si un modelo está visible en una cuenta española ni el precio regional de Bedrock, Google Cloud, Microsoft Foundry o un intermediario.

La métrica útil es el coste por tarea aceptada

Toma una muestra pequeña de tareas reales: casos habituales, casos difíciles y errores con consecuencias. Define una condición observable para cada una, como tests, schema válido, cifras conciliadas con sus fuentes o un proceso de navegador terminado. Ejecuta ambos candidatos con la misma entrada, herramientas, permisos, tiempo máximo, regla de parada y criterio de aceptación.

Registra cada componente que puede mover el resultado:

DatoQué debe conservar
Tokensentrada nueva, escrituras, lecturas, thinking y salida por separado
Resultadoéxito inicial, éxito tras reintento o fallo definitivo
Tiempohasta la primera respuesta aceptada, mediana y P95
Problemastimeout, refusal, tool call errónea, bucles y fallback
Personaaclaraciones, revisión, corrección y recuperación de contexto
Retrabajocambios deshechos o rehechos antes y después de entregar

Calcula después:

coste por tarea aceptada = (tokens + tools + reintentos + revisión humana + retrabajo) ÷ tareas aceptadas

Si Opus pasa de forma estable a la primera, la lectura barata de Fable difícilmente compensará su entrada y salida al doble de precio. Si un agente largo relee el mismo repositorio y Fable reduce suficientes turnos o reparaciones, asígnalo solo a ese grupo de trabajo.

Fable 5.1 y Opus 5 comparados por tarifas, fórmula y ejemplo de caché, coste publicado por Devin, gama Claude y verificación de facturación
Fable 5.1 y Opus 5 comparados por tarifas, fórmula y ejemplo de caché, coste publicado por Devin, gama Claude y verificación de facturación

Antes de cambiar, confirma dónde se facturará

El cálculo anterior corresponde a peticiones estándar, facturadas por token en Claude API directo. Batch, fast mode, el multiplicador documentado para inferencia solo en Estados Unidos, las tarifas regionales de nubes asociadas, los márgenes de una pasarela y las suscripciones de Claude generan cuentas distintas.

Fable 5.1 también mantiene adaptive thinking siempre activo y tiene condiciones propias para tool choice y thinking blocks conservados. Antes de ampliar tráfico, comprueba effort, max_tokens, aciertos de caché, comportamiento de herramientas, refusals y rollback. La guía específica de Claude Fable 5.1 reúne el contrato del modelo y los cambios de migración.

Para la mayoría de equipos, la primera prueba defendible es Opus 5, o incluso Sonnet 5 si el coste del fallo es moderado. Fable 5.1 solo debería recibir las tareas donde una muestra real demuestre una capacidad necesaria o un menor coste completo.