La diferencia entre Claude Haiku, Sonnet, Opus y Fable no se resuelve preguntando cuál es “el mejor”. Antes de pagar hay tres preguntas más útiles: qué contrato vas a comprar, cuánto cuesta que la tarea falle y qué evidencia exigirás para subir de modelo.
La hipótesis inicial, comprobada con las especificaciones vigentes el 15 de agosto de 2026, es práctica: Haiku 4.5 para volumen verificable; Sonnet 5 como referencia diaria; Opus 5 para trabajo complejo, largo o difícil de revertir; Fable 5 solo para el subconjunto donde Opus ya muestra un límite repetible. No es una clasificación permanente. Es el orden en que conviene probar una cartera.

Primera pregunta: ¿compras API, Claude Code o una suscripción?
claude-fable-5, claude-opus-5, claude-sonnet-5 y claude-haiku-4-5-20251001 son IDs de Claude API. Claude Code y el chat de Claude añaden selección de contexto, herramientas, permisos, límites del plan, usage credits y reglas de producto. Bedrock y Google Cloud tienen sus propios endpoints y contratos de precio.
Por eso, el coste por token no responde a “cuánto cuesta una sesión de Claude Code”. Que un modelo exista en la API tampoco garantiza que aparezca en el selector de tu cuenta. Esta comparativa usa la API directa de Anthropic; revisa disponibilidad, contador y política de organización en el producto que realmente pagarás.
El contrato actual de los cuatro modelos
El resumen oficial de modelos de Anthropic publica estas bases:
| Modelo | Entrada / salida por millón de tokens | Contexto / salida máxima | Primera carga que probar |
|---|---|---|---|
| Haiku 4.5 | $1 / $5 | 200K / 64K | clasificación, extracción, resumen y rutas acotadas |
| Sonnet 5 | $2 / $10 | 1M / 128K | código, análisis, vision y herramientas cotidianas |
| Opus 5 | $5 / $25 | 1M / 128K | sistemas, agentes largos y cambios de alto riesgo |
| Fable 5 | $10 / $50 | 1M / 128K | tareas que agotan la capacidad de Opus |
Una página antigua de pricing aún menciona que Sonnet 5 subiría a $3/$15 en septiembre. Sin embargo, el anuncio de Sonnet 5 actualizado el 10 de agosto hizo permanente el precio $2/$10 y el overview actual coincide. Vuelve a comprobarlo antes de un compromiso importante.
La tabla tampoco es un cálculo de rentabilidad. Haiku puede costar la mitad que Sonnet por token y salir más caro si rompe el schema, repite llamadas y exige corrección humana. Fable cuesta el doble que Opus en entrada y salida; solo compensa si reduce intervención o retrabajo más de lo que aumenta la factura. Una ventana de 1M no obliga a enviar logs viejos y archivos duplicados: el contexto irrelevante sigue costando tiempo y dinero.
Segunda pregunta: ¿qué pasa cuando falla?
Fallo barato y detectable. Una clasificación, extracción de campos o transformación corta puede repetirse. Si un schema, una regla de negocio o una muestra humana descubre el error rápido, compara Haiku con Sonnet. Cuenta reintentos y reparaciones, no solo el precio de la primera llamada.
Fallo que consume una tarde. Código habitual, análisis documental, vision y cadenas de herramientas empiezan bien en Sonnet. Si cumple sin supervisión desproporcionada, ya tienes un default económico y capaz.
Fallo caro de revertir. Una migración, una depuración profunda, un refactor de muchos archivos o un agente que mantiene estado durante horas necesita mejor recuperación y continuidad. Usa Opus como control, mide distintos niveles de effort y conserva rollback.
Fallo por techo de capacidad. Fable entra cuando puedes nombrar el déficit de Opus: cadenas largas incompletas, rubric de investigación que no alcanza, vision difícil o intervención estructural que no baja. El anuncio de Fable 5 lo presenta como el modelo de mayor capacidad ampliamente publicado; eso no lo convierte en un default sensato para solicitudes simples.
El resultado es una cartera: cada tipo de trabajo tiene una ruta inicial y un coste de error permitido. Si todas las rutas empiezan en Fable, no sabrás dónde estabas pagando capacidad que no utilizas. Si todas empiezan en Haiku, esconderás el coste en reintentos y revisión.
Cambiar el nombre no basta para migrar
El contrato de thinking cambia. Fable 5 mantiene adaptive thinking siempre activo. Opus 5 y Sonnet 5 lo usan por defecto y regulan profundidad con effort. Haiku 4.5 admite extended thinking manual, pero no adaptive thinking.
Copiar en Sonnet 5 una configuración de Haiku como thinking: {type: "enabled", budget_tokens: N} puede devolver HTTP 400. Sonnet 5 tampoco admite valores no predeterminados de temperature, top_p y top_k. Su tokenizer nuevo puede contar más tokens que Sonnet 4.6 para el mismo texto, de modo que precio, truncado y max_tokens deben volver a medirse.
Antes del canary, sigue la guía de migración y comprueba model ID, thinking, effort, sampling, output, cache, streaming, tool calls, refusals y fallback. La guía de versiones aclara que los IDs sin fecha de las generaciones 4.6 o posteriores son snapshots fijados, no alias latest que se actualizan solos. Trata cada cambio de ID como un despliegue.
Tercera pregunta: ¿qué prueba justificaría subir de nivel?
No necesitas un torneo completo. Compara Haiku con Sonnet para el carril de volumen, Sonnet con Opus para el trabajo diario complejo y Opus con Fable para el conjunto límite. Selecciona entre 8 y 15 tareas reales con un criterio observable: schema, tests, rubric factual, navegador o condición de negocio.
Ambos candidatos reciben las mismas entradas, herramientas, permisos, timebox y regla de parada. Si uno se ejecuta dentro de un Claude Code maduro y otro mediante un script API mínimo, llama al resultado comparación de configuraciones de producto, no benchmark puro del modelo.
| Señal | Registro útil |
|---|---|
| Aceptación | superó todas las comprobaciones reales |
| Consumo | entrada, caché, thinking, salida y tools por separado |
| Tiempo | primera aceptación; mediana y P95, no primer mensaje |
| Persona | preguntas, permisos, edición, reinicios y recuperación |
| Fallos | timeout, refusal, tool call incorrecta, bucle y fallback |
| Retrabajo | qué se deshizo o reescribió después de revisar |
El cálculo que importa es:
coste por tarea aceptada = (modelo + tiempo humano + retrabajo) / tareas aceptadas
Una llamada barata que no pasa no produce trabajo barato. Una llamada cara solo merece la ruta principal cuando varias muestras reducen la cola de fallos, la intervención o el retrabajo por encima de la variación normal y del coste de migración.
La guía de selección de Anthropic también recomienda evaluar con tus prompts y datos. Conserva un flujo canary y revisa la decisión cuando cambien precios, tokenizer, herramientas, model ID o distribución de tareas.
Política inicial para una cartera Claude

- Haiku recibe tareas estrechas hasta superar el umbral de schema o reintentos.
- Sonnet atiende la carga diaria y sube cuando el coste del error o la longitud de la cadena lo exigen.
- Opus recibe trabajo de alto riesgo; prueba Fable solo después de agotar un
efforty timebox definidos. - Fable conserva el subset donde la mejora frente a Opus ya aparece en trabajo aceptado, no en impresiones.
También permite bajar. Una parte estable de Sonnet puede volver a Haiku mediante canary; un subset corto y reversible de Opus puede volver a Sonnet. Sin descenso, todo sistema de escalado acaba enviando demasiado tráfico a la opción cara.
Si tu decisión real trata de permisos de shell, interfaz, suscripción, trabajo local, delegación cloud y entrega en equipo, no de estos cuatro contratos API, separa el problema con la comparación Claude Code vs Codex.



