Migrar a Claude Fable 5.1 no se acaba cambiando el ID del modelo. La documentación oficial deja escrito que «tres de los cambios son incompatibles» (What's new in Claude Fable 5.1). Y, además, en dos de ellos el sitio donde salta el error queda lejos de la causa: son de los que cuesta ver.

⚠️ El tercero se aplica de forma obligatoria en las cuentas creadas a partir del 31 de agosto de 2026. En las cuentas anteriores, la API solo registra el desajuste y no lo refleja en el comportamiento salvo que se lo indiquemos de forma explícita.

Es decir, el «a nosotros nos funciona» depende de cuándo se creó la cuenta. Puede darse la contradicción de que falle en un entorno de pruebas recién creado y no falle en producción.

1. Primero, dónde encaja: no es un relevo del buque insignia

Equivocarse aquí lleva a errar en la propia decisión de migrar. Fable 5.1 es el sucesor de Fable 5, no un sustituto de Opus 5.

La documentación oficial lo dice sin rodeos: «empieza por Claude Opus 5 para la mayoría de las cargas de trabajo». Fable 5.1 se reserva para «el razonamiento exigente y el trabajo agéntico de larga duración» o para «cuando Opus 5, evaluado con un effort alto, sigue quedándose corto».

  Claude Fable 5.1 Claude Opus 5
Dónde encaja Razonamiento exigente y trabajo agéntico de larga duración Empieza por aquí (codificación agéntica compleja y uso empresarial)
Precio (por millón de tokens) Entrada $10 / salida $50 Entrada $5 / salida $25
Lectura de caché $0.25 (0.025 veces la entrada base) 0.1 veces la entrada base
Corte de conocimiento Junio de 2026 Mayo de 2026
Contexto / salida máxima 1M / 128k 1M / 128k
No se retirará antes de 1 de septiembre de 2027 24 de julio de 2027

Fable 5 no ha desaparecido. En el listado oficial de modelos sigue figurando como legacy (se mantiene disponible). La migración no está forzada ahora mismo, aunque, como se ve más abajo, el coste baja.

Mythos 5.1 tiene el mismo rendimiento y solo cambian sus salvaguardas. Está disponible únicamente para los participantes de Project Glasswing.

📌 Del lado de la suscripción: el día del lanzamiento se reinició el uso. La cuenta oficial @ClaudeDevs anunció que, coincidiendo con la publicación de 5.1, reiniciaron las ventanas de 5 horas y semanal de todos los usuarios. Esto no va de precios de la API, sino de la cuota de uso de las suscripciones, como la de Claude Code, y además no es una especificación permanente, sino una medida puntual vinculada a un gran anuncio. Cuántas veces ha ocurrido este tipo de reinicio, y hasta dónde llega lo confirmado y dónde empieza lo no verificado, se trata en el artículo que investiga los reinicios anticipados del límite semanal. Ten en cuenta, además, que el propio límite semanal se revisa el 14 de septiembre de 2026, así que consúltalo también si vas a planificar en torno a tu cuota.

2. Cambio incompatible 1: forzar la llamada de herramienta devuelve 400

Este salta como error al momento, así que es el más fácil de encontrar.

tool_choice: type "tool" and "any" are not supported for this model.

Si pasas {"type": "any"} o {"type": "tool", "name": "..."} en tool_choice, la respuesta es un 400 invalid_request_error. Los valores por defecto {"type": "auto"} y {"type": "none"} no cambian. La misma validación se aplica al endpoint de recuento de tokens.

💡 El motivo está explicado de una forma que convence. Este modelo piensa siempre, y forzar la llamada de herramienta se salta ese pensamiento. El modelo acaba escribiendo lo que había razonado dentro de los argumentos de la herramienta, y la calidad de esos argumentos empeora: por eso lo han cerrado.

Qué hacer en su lugar

Si quieres que respete el esquema

Deja tool_choice: auto y activa strict: true (strict tool use), o pásate a structured outputs

Si quieres que use la herramienta sí o sí

Escribe en el prompt cuándo debe usarla («responde al tiempo con la herramienta get_weather»). La documentación oficial afirma que «Fable 5.1 sigue de forma fiable las instrucciones explícitas sobre herramientas»

3. Cambio incompatible 2: el bloque de pensamiento queda ligado al modelo

A partir de aquí la cosa se complica. Los bloques de pensamiento pasan a llevar registrado qué modelo los creó, y la dirección en la que se conservan es de sentido único.

✅ La dirección que se conserva

Las conversaciones que pasan de una generación anterior (Opus 5, Fable 5 o previos) a Fable 5.1 pueden continuar conservando el razonamiento

❌ La dirección que se pierde

Al pasar de Fable 5.1 a una generación anterior, se pierde el razonamiento de los turnos que se ejecutaron allí. Las generaciones anteriores no pueden leer los bloques de pensamiento de Fable 5.1

⚠️ Lo más peligroso es que, por defecto, falla en silencio. Cuando llega una petición con bloques ilegibles mezclados, la API los descarta antes de enseñárselos al modelo. Lo descartado no se cuenta en input_tokens ni se cobra: o sea, tampoco aparece en la factura.

Esto golpea a los montajes que cambian de modelo a mitad de conversación. Enrutadores, mecanismos de respaldo, selección dinámica de modelo para optimizar el coste. Cualquiera de ellos puede acabar en un estado en el que «parece que funciona» y lo único que se cae es el razonamiento.

Para poder enterarte, añade la cabecera beta thinking-binding-controls-2026-08-01. Entonces los descartes se informan en el array input_transformations de nivel superior. Si no la añades, no hay ningún aviso.

4. Cambio incompatible 3: editar turnos pasados lo rompe

De los tres, este es el que alcanza a más código existente. Si modificas algo que esté por delante de un bloque de pensamiento de Fable 5.1 (el prompt de system, las tools o los mensajes anteriores), la siguiente petición da error.

The block is bound to a different conversation

Patrones que invalidan todos los bloques de pensamiento posteriores

  • Editar, reordenar o eliminar turnos pasados dejando los turnos posteriores
  • Insertar en turnos pasados un texto propio de cada petición y borrarlo en la siguiente (recordatorios o líneas de estado)
  • Reconstruir el prompt de system o el array tools dentro de la misma conversación
  • Que la URL de una imagen o de un documento devuelva bytes distintos en una petición posterior (se miran los bytes, no la URL; si es el mismo archivo, no importa que la URL firmada vaya rotando)

Lo que, en cambio, no rompe nada

  • Quitar bloques de pensamiento de forma consecutiva desde el principio (de los más antiguos a los más nuevos)
  • Recortar el historial con la compactación del lado del servidor o con la edición de contexto
  • Mover los marcadores cache_control
  • Cambiar el effort entre peticiones

Ojo con esto: si quitas un bloque de pensamiento que no sea el primero, todo lo que viene después queda invalidado.

⚠️ Que se aplique o no depende de cuándo se creó la cuenta. Esta comprobación es obligatoria en las cuentas creadas a partir del 31 de agosto de 2026. En las anteriores, la API solo registra el desajuste y únicamente lo refleja en el comportamiento si configuras thinking.block_binding.prefix_mismatch_behavior.

Puede darse la contradicción de que falle en un entorno de pruebas recién creado y no falle en producción. Y también al revés.

Cómo comprobar si tu código está afectado

La documentación oficial da un procedimiento concreto: indica prefix_mismatch_behavior: "drop_block", ejecuta una sesión y vuelca input_transformations en el log. Si estás editando el historial, ahí aparecerá reason: "prefix_binding_mismatch".

Conviene saber que Claude Code, claude.ai, Claude Managed Agents y el Claude Agent SDK están hechos para no romper esa parte previa. Solo queda afectado el código que construye por su cuenta el array messages.

5. La lectura de caché baja a la cuarta parte: cuánto se ahorra de verdad

Ni la entrada ni la salida han subido de precio. Lo único que ha cambiado es la lectura de caché.

Concepto Por millón de tokens
Entrada base $10
Escritura en caché (5 minutos) $12.50
Escritura en caché (1 hora) $20
Lectura de caché $0.25
Salida $50
Procesamiento por lotes Entrada $5 / salida $25

Cuánto se nota depende de cuántas veces se relea el preámbulo cacheado. En los demás modelos de Claude, la lectura de caché cuesta 0.1 veces la entrada base; en Fable 5.1 y Mythos 5.1, 0.025 veces. Cuanto más larga sea la ejecución agéntica que relee una y otra vez el mismo preámbulo, mayor será la diferencia.

El efecto que cita la documentación oficial es de alrededor de un 25% menos en cargas de trabajo típicas y de hasta cerca de un 45% menos en trabajo marcadamente agéntico. La escritura en caché y la longitud mínima de caché, de 512 tokens, no han cambiado.

6. Siete comportamientos que cambian sin tocar el código

Aquí es donde más se escapan cosas al migrar. Aunque la especificación de la API sea la misma, cambia lo que sale. La documentación oficial enumera siete puntos.

Bajan las llamadas de herramienta en paralelo

Donde Fable 5 las lanzaba todas juntas, puede hacer una sola llamada por turno. La calidad de la respuesta no baja, pero suben los tokens, las idas y vueltas y el tiempo real

Habla menos de su progreso

Se nota sobre todo con un effort alto. Si tu interfaz depende de esa narración, parecerá que se ha quedado mudo

Con effort low tiende a responder de memoria

Baja la frecuencia con la que llama a las herramientas de búsqueda y de recuperación. En los turnos que necesiten información nueva, sube el effort

La prosa se vuelve más densa

Puede que las frases sean más largas y que haya menos cortes entre párrafos

Formatea menos

Usa menos negritas, encabezados y listas que antes. Las instrucciones de «no formatees» escritas para los modelos antiguos ahora hacen demasiado efecto

A veces no marca las citas al resumir

Al resumir un documento, tiende a reproducir pasajes del original sin que se vea que son citas

Reescribe el texto entero aunque el arreglo sea mínimo

Aunque el resultado sea el mismo, gasta tokens de salida y tiempo de más

Para cada uno de ellos hay una solución de prompt propuesta oficialmente. Para las llamadas en paralelo, añadir una línea del tipo «lanza juntas las lecturas independientes»; si necesitas ver el progreso, pedir de forma explícita que hable al principio, por el medio y al cerrar.

7. Funciones que se han añadido

La documentación oficial enumera cinco añadidos. Uno de ellos es la bajada de precio de la lectura de caché, que por su impacto hemos tratado aparte, en el capítulo 5. Aquí vemos los cuatro restantes.

Cambiar el effort a mitad de conversación (beta)

Puedes subir y bajar la eficiencia sin romper la caché de prompts. Súbelo en los pasos difíciles y bájalo en los rutinarios

Mensaje de sistema limitado a un turno (beta)

clear_at: "next_user_message". Es la función que sustituye sin riesgo el «insertar y borrar» del tercer cambio, y no reescribe el historial

Recibir el progreso como texto (beta)

display: "updates". Manteniendo oculto el razonamiento, puedes recibir como texto solo el progreso entre llamadas de herramienta

Procedencia del contenido

Marca de agua estadística en el texto generado. No añade tokens ni caracteres ocultos, y no lleva información del usuario ni de la organización. Para imágenes y vídeos, C2PA

Fíjate en la segunda. Frente a esa forma de escribir que el tercer cambio incompatible prohíbe, la de insertar un recordatorio y luego borrarlo, se ofrece a la vez una alternativa que cumple el mismo objetivo. La migración no toma la forma de «deja de hacerlo», sino la de «múdate a esto».

8. Pasos de migración: cinco comprobaciones

Además de cambiar el ID del modelo, la documentación oficial señala estos cinco puntos.

model = "claude-fable-5"    # Before
model = "claude-fable-5-1"  # After
  Qué comprobar
1 Quita any y tool de tool_choice. Para forzar el esquema, pásate a strict tool use o a structured outputs
2 Devuelve los bloques de pensamiento tal cual y haz que el historial solo crezca por el final. Lo que insertabas y borrabas, al mensaje de sistema limitado a un turno; los cambios de system y de tools, a la función de cambio a mitad de conversación
3 Reajusta el effort desde su valor por defecto (high). Plantéate también cambiarlo a mitad de conversación
4 Mira si el bucle de tu agente ha pasado a hacer una sola llamada por turno
5 Vuelve a pasar tus evaluaciones. El trato de los rechazos, el respaldo y el recuento de tokens no cambian

Lo relativo a los rechazos no ha cambiado. stop_reason: "refusal" se sigue devolviendo, y los modelos admitidos como respaldo de Fable 5.1 son Opus 4.8 y Opus 5. Un rechazo que llegue antes de la salida no se cobra, y el coste de caché de prompts del cambio de modelo se devuelve como crédito de respaldo.

📌 La retención de datos es de 30 días y, por norma general, no se puede usar la retención cero (salvo que Anthropic lo apruebe de forma explícita). Igual que Fable 5 y Mythos 5, entra en la categoría de Covered Model. Según los requisitos que tengas, esto puede decidir por sí solo si lo puedes adoptar.

Resumen

  • No es un relevo del buque insignia. La documentación oficial deja escrito que «para la mayoría de los usos, empieza por Opus 5», y Fable 5.1 está pensado para el razonamiento exigente y el trabajo agéntico de larga duración
  • Los cambios incompatibles son tres. Forzar la llamada de herramienta devuelve 400; el bloque de pensamiento queda ligado al modelo; editar turnos pasados los invalida
  • El segundo falla en silencio. Los bloques ilegibles se descartan y ni siquiera aparecen en la factura. Para enterarte hace falta la cabecera beta
  • En el tercero, que se aplique depende de cuándo se creó la cuenta (a partir del 31 de agosto de 2026 es obligatorio). El entorno de pruebas y producción pueden comportarse de forma distinta
  • No hay subida de precio. Solo la lectura de caché baja a la cuarta parte (0.025 veces la entrada base). El efecto depende de cuántas veces se relea el mismo preámbulo
  • Siete comportamientos cambian sin tocar el código. Que bajen las llamadas de herramienta en paralelo afecta directamente al coste y al tiempo

FAQ

Q1. ¿Hay que migrar ya?

Nadie te está metiendo prisa. Fable 5 sigue disponible como legacy y se ha declarado que no se retirará antes del 1 de septiembre de 2027. El motivo para migrar es el coste: la lectura de caché baja a la cuarta parte, así que cuanto más larga sea la ejecución que relee una y otra vez el mismo preámbulo, más sale a cuenta. Si, por el contrario, lo tuyo son sobre todo llamadas cortas y sueltas, la diferencia es pequeña.

Q2. Si solo uso Claude Code, ¿me afectan los cambios incompatibles?

El tercero no te afecta. La documentación oficial deja escrito que Claude Code, claude.ai, Claude Managed Agents y el Claude Agent SDK están hechos para no romper esa parte previa. A quien afecta es al código que construye por su cuenta el array messages.

Q3. Tengo un mecanismo que cambia de modelo de forma dinámica. ¿Qué debo arreglar?

Aquí está el meollo del segundo cambio. Al pasar de Fable 5.1 a una generación anterior, se pierde el razonamiento de ese turno. Y por defecto se descarta en silencio, sin aparecer siquiera en la factura. Lo primero es añadir la cabecera beta thinking-binding-controls-2026-08-01, volcar input_transformations en el log y medir si de verdad se están produciendo descartes.

Q4. ¿Cuál elijo, Opus 5 o Fable 5.1?

Lo razonable es quedarse con la formulación oficial: prueba primero con Opus 5 y pasa a Fable 5.1 «cuando ni con un effort alto es suficiente». El precio es el doble que el de Opus 5 tanto en entrada como en salida, y solo la lectura de caché resulta, al revés, más barata. Los detalles de cuándo usar cada uno están en la guía para elegir.

Q5. Quiero borrar bloques de pensamiento para ahorrar contexto

Hay condiciones sobre cómo borrarlos. Quitarlos de forma consecutiva desde el principio, de los más antiguos a los más nuevos, no da problemas, pero si quitas uno de en medio, todos los bloques de pensamiento posteriores quedan invalidados. Si usas la edición de contexto del lado del servidor o la compactación, no se considera una edición.

Q6. Dicen que lleva marca de agua. ¿Afecta a la salida?

La documentación oficial dice que no afecta: no cambia el significado, la calidad ni la legibilidad, no añade tokens ni caracteres ocultos y tampoco incluye información del usuario ni de la organización. Tampoco hay que cambiar nada en las peticiones ni en las respuestas. A las imágenes y los vídeos se les añaden las Content Credentials de C2PA a través de la Files API.

Q7. ¿Puedo usar Mythos 5.1?

El rendimiento es el mismo que el de Fable 5.1, pero está disponible solo para los participantes de Project Glasswing. La diferencia está en las salvaguardas: por ejemplo, en Terminal-Bench 4.0, frente al 55.8% de Fable 5.1, Mythos 5.1 obtiene un 60.9%; se explica que la diferencia se debe a que es el mismo modelo y solo cambian las salvaguardas.

Artículos relacionados