No hay un ganador universal entre GPT-5.6 Sol y Claude Fable 5. Para decidir entre Codex y Claude Code, ejecuta la misma tarea desde el mismo commit, con permisos equivalentes y los mismos criterios de aceptación. Después compara el coste total de cada cambio que realmente haya pasado.
Antes de esa prueba hay dos filtros: que el modelo esté disponible para las cuentas que lo usarán y que sus cargos salgan del presupuesto previsto. La longitud de la tarea no permite anticipar que Sol o Fable será mejor. Tampoco basta con comparar el precio por token, porque la configuración del agente, los reintentos, la revisión humana y el retrabajo cambian el resultado.
Los precios, planes y requisitos de esta guía se comprobaron el 12 de agosto de 2026. Revisa las fuentes enlazadas antes de contratar o migrar un equipo.
Qué estás comparando realmente: modelo, agente y forma de cobro
Sol y Fable son modelos. Codex y Claude Code son entornos de programación con agentes: reúnen contexto, seleccionan archivos, solicitan permisos, ejecutan herramientas y, según el modo, coordinan trabajo adicional. La API o el plan determina cómo se descuenta el uso. Dar el mismo texto a ambos productos no iguala automáticamente esas capas.
| Capa | GPT-5.6 Sol | Claude Fable 5 | Dato que debes registrar |
|---|---|---|---|
| Modelo | gpt-5.6-sol; alias gpt-5.6 | claude-fable-5 | Identificador exacto usado |
| API | 1,05 millones de contexto y 128K de salida máxima | 1 millón de contexto y hasta 128K de salida | API directa o producto agente |
| Entorno | Permisos, herramientas, capacidades y modos de Codex | Permisos, hooks, capacidades y herramientas de Claude Code | Configuración efectiva del repositorio |
| Cobro | Créditos de Codex o API en USD | Límite semanal, créditos de uso o API en USD | Saldo que se redujo en la prueba |

La ficha oficial de GPT-5.6 Sol confirma el ID gpt-5.6-sol, 1,05 millones de tokens de contexto y 128K de salida máxima. En Codex, además, importa el plan. La tabla oficial de consumo de Codex asigna a Sol 125 créditos de entrada, 12,5 de entrada en caché y 750 de salida por MTok. Son cifras de la tarifa por tokens de Sol; no deben generalizarse a modelos heredados o modalidades que la propia tabla contabiliza de otra forma.
En Claude, decir «está incluido en un plan de pago» oculta diferencias importantes. Según la guía de Anthropic sobre Fable 5 y los planes, Fable no está disponible en Free. Desde el 20 de julio de 2026, Max, los asientos premium de Team y las suscripciones Enterprise antiguas basadas en asientos pueden dedicar hasta el 50% de su límite semanal a Fable. Pro, los asientos estándar de Team y los asientos estándar de esos Enterprise antiguos consumen créditos de pago por uso desde el principio.
Para usarlo en Claude Code también necesitas la versión 2.1.170 o posterior, una organización que lo permita y acceso en la cuenta. La configuración oficial de modelos de Claude Code explica la selección mediante /model o claude --model claude-fable-5.
Comprueba el selector de modelos, la versión, el estado de la sesión, las políticas de la organización y el contador antes de iniciar. Si una opción no está disponible o carga un presupuesto no autorizado, no fuerces la prueba: todavía no existe una comparación comprable.
Cuánto cuestan las API de Sol y Fable 5
Con API directa y hasta 272K tokens de entrada, las tarifas estándar publicadas son:
| Por 1 millón de tokens | GPT-5.6 Sol | Claude Fable 5 |
|---|---|---|
| Entrada | $5 | $10 |
| Lectura de entrada en caché | $0,50 | $1 |
| Salida | $30 | $50 |
| Contexto / salida máxima | 1,05 millones / 128K | 1 millón / 128K |
Una solicitud sin caché con 100K tokens de entrada y 20K de salida costaría $1,10 con Sol y $2,00 con Fable. El cálculo solo describe la API del modelo. No representa una sesión de Codex o Claude Code ni incluye herramientas, agentes adicionales, reintentos, impuestos o trabajo humano.
La página de precios de Sol añade dos condiciones necesarias para presupuestar correctamente:
- escribir una entrada nueva en caché cuesta 1,25 veces la tarifa normal de entrada, es decir, $6,25 por millón de tokens escritos; leerla después cuesta $0,50;
- con más de 272K tokens de entrada, toda la solicitud se factura a 2 veces la entrada y 1,5 veces la salida, no solo la parte que supera el umbral.
Por encima de ese límite, Sol pasa de forma efectiva a $10 por MTok de entrada y $45 de salida. Frente a los $10/$50 de Fable, desaparece la diferencia grande de entrada. Aun así, esa comparación no predice el coste de un cambio terminado por un agente.
Para medir el coste real, suma el consumo de todos los intentos, las escrituras y lecturas de caché, los agentes secundarios, el tiempo hasta la aceptación y el código que una persona tuvo que corregir. Los créditos de Codex, el límite semanal de Claude, los créditos de uso y los dólares de API no son unidades intercambiables. Registra primero el cargo real en cada sistema y compáralo por resultado aceptado.
Los benchmarks no sustituyen una prueba en tu repositorio
El anuncio de GPT-5.6 de OpenAI muestra por qué no conviene elegir una sola cifra: Sol obtiene 80 frente a 77,2 de Fable en Artificial Analysis Coding Agent Index, mientras SWE-Bench Pro muestra 64,6% para Sol y 80% para Fable.
Los conjuntos de tareas, el entorno agente y la configuración no son iguales. El resultado cambia con el esfuerzo de razonamiento, la selección y compactación de contexto, los permisos, las herramientas y el número de agentes. Comparar Codex Ultra con varios agentes frente a una sesión individual de Claude Code puede responder qué producto rinde mejor en esa configuración, pero no aísla el modelo. Todos los agentes y sus cargos forman parte del resultado.
Usa el benchmark público para plantear una hipótesis. La decisión de compra exige reproducirla con el código, las restricciones y las comprobaciones de tu equipo.
Cómo hacer una comparación justa con la misma tarea
Elige un cambio real cuyo resultado pueda aprobarse o rechazarse: corregir un fallo que toca varios archivos, implementar una función limitada con pruebas o hacer un refactor con comportamiento conservado. No asignes Sol a lo corto y Fable a lo largo de antemano; eso contamina la comparación antes de observar el trabajo.
Parte del mismo estado y concede capacidades equivalentes
Prepara dos copias limpias del mismo commit. Define un único resultado esperado, los archivos que se pueden modificar, los comandos permitidos, el tiempo disponible y los criterios de aceptación. Las instrucciones pueden usar la sintaxis natural de cada producto, pero no deben dar a uno información, secretos, herramientas o permisos que el otro no tenga.
Anota en cada ejecución:
- ID exacto del modelo, versión del producto y modo de agentes;
- commit inicial, instrucciones del repositorio y herramientas disponibles;
- permisos concedidos y confirmaciones solicitadas;
- pruebas obligatorias y límite de tiempo;
- contador utilizado y variación de su saldo.
Si Codex ya tiene instrucciones, integraciones y permisos maduros mientras Claude Code arranca sin preparación, el resultado mide la madurez de tus entornos. Eso puede ser decisivo para comprar, pero no demuestra que el modelo sea intrínsecamente superior. Para una prueba de migración realista, conserva esa ventaja como coste de cambio; para estudiar los modelos, iguala las capacidades.
Aplica exactamente los mismos criterios de aceptación
No puntúes la conversación, la velocidad del primer mensaje ni lo convincente de la explicación. Evalúa el cambio final con las puertas que aplicarías a código humano:
- compilación, pruebas unitarias y de integración, lint y comprobación de tipos;
- migraciones y controles de seguridad cuando los afecte la tarea;
- revisión en navegador y visual para una interfaz;
- límites de alcance, mantenibilidad y comportamiento no solicitado;
- el resultado de negocio concreto que motivó el cambio.
Si el primer intento falla, ofrece a ambos la misma clase de corrección y el mismo presupuesto adicional. Cuenta preguntas, autorizaciones, reinicios y arreglos manuales como intervención. Un cambio que solo funciona después de que una persona lo rescate no tiene el mismo coste que uno aceptado sin esa ayuda.

Compara el coste por cambio aceptado
| Medida | Registro necesario |
|---|---|
| Resultado | aprobado o rechazado y comprobaciones fallidas |
| Consumo | tokens, créditos de Codex o créditos de uso de Claude por intento |
| Tiempo | desde el inicio hasta la aceptación, no hasta la primera respuesta |
| Intervención | preguntas, permisos, reinicios y código manual |
| Retrabajo | código eliminado o reescrito después de revisar |
| Fricción | rechazos, bloqueos de permisos, pérdida de contexto y errores de herramientas |
Suma también los intentos fallidos. Divide el coste acumulado entre los cambios que superaron todas las puertas. Esa cifra evita que una ejecución barata pero inutilizable parezca mejor que otra con mayor consumo y menos supervisión.
Repite con más de una tarea representativa. Si la diferencia es menor que la variación normal entre ejecuciones, todavía no hay evidencia para migrar.
Cómo registrar los rechazos y el cambio automático de modelo
Anthropic explica en la documentación técnica de Fable 5 que un rechazo de seguridad puede llegar con HTTP 200 y stop_reason: "refusal"; no es necesariamente un fallo de transporte. Si ocurre antes de generar salida, la solicitud no se factura. La API admite rutas de cambio de modelo en servidor, SDK o de forma manual.
Comprueba primero la razón de finalización y después procesa la respuesta. Si una ruta alternativa ejecutó otro modelo, etiqueta el resultado como una cadena de modelos y suma su coste; ya no es una ejecución exclusiva de Fable.
Sol también aplica salvaguardas. Para trabajo de seguridad, especifica el entorno autorizado, las herramientas permitidas y el resultado defensivo esperado. Saltarse una restricción de cuenta no es un criterio válido de calidad.
Cuándo conservar tu entorno y cuándo migrar
Toma como referencia el entorno que el equipo ya tiene configurado. Prueba la alternativa solo si las cuentas objetivo pueden usarla y su forma de cobro encaja en el presupuesto.
Una migración a Codex con Sol o a Claude Code con Fable está justificada cuando la alternativa, en varias pruebas comparables:
- supera los mismos criterios de aceptación al menos con la misma fiabilidad;
- reduce la intervención humana y el retrabajo;
- baja el coste total por cambio aceptado;
- mantiene esa ventaja después de trasladar instrucciones, permisos, hooks, herramientas y hábitos de revisión.
Conserva el entorno actual si la alternativa no está disponible para todo el equipo, consume un fondo no aprobado, falla de manera repetida o la mejora no compensa el coste de migración. Si un modelo más barato dentro de la misma cadena supera las mismas pruebas, úsalo: ni Sol ni Fable tienen que ser la opción predeterminada por llevar la etiqueta más alta.
La ruta final depende de cinco hechos, en este orden: disponibilidad, fondo de cobro, madurez de las herramientas, aceptación en el mismo repositorio y coste total de cada cambio aceptado. Ninguno puede deducirse de que la tarea parezca corta, larga, sencilla o compleja. Si tu decisión se centra en trabajo local o en la nube, delegación, permisos y entrega entre agentes, continúa con Claude Code frente a Codex.



