Contenido
- 1. Lo esencial de Opus 5.5: rendimiento, precio y riesgos de la migración
- 2. Especificaciones y dónde está disponible
- 3. Precio: más barato que Opus 5, pero depende de con qué lo compares
- 4. Benchmarks: comparando solo dentro de la tabla de Anthropic
- 5. Dónde no gana y cómo leer la tabla
- 6. Qué implica que el effort por defecto pase a medium
- 7. Cuatro cosas que se rompen al pasar desde Opus 5, y cómo arreglarlas
- 8. Cambios que llegan sin ningún error
- 9. Qué cambia en Claude Code y en claude.ai
- 10. Cómo elegir entre Opus 5.5, Fable 5.1, Sonnet 5 y Opus 5
- 11. Pasos de migración (para quien usa la API)
- Conclusiones
- Preguntas frecuentes
El 22 de septiembre de 2026, Anthropic lanzó Claude Opus 5.5. El anuncio lo presenta como el primer modelo de la familia Claude 5.5, y llega apenas dos meses después de Opus 5 (lanzado el 24 de julio). En el resumen de modelos de la documentación oficial ya figura como el punto de partida recomendado para la mayoría de los casos cuando no tienes claro qué modelo elegir, y Opus 5 ha pasado a Legacy (más antiguo, pero todavía disponible).
En pocas palabras: el precio ha bajado respecto a Opus 5 ($4 de entrada / $20 de salida, frente a los $5 / $25 de Opus 5). Pero el comportamiento de la API ha cambiado mucho, y hay cuatro cambios que convierten en errores 400 un código que funcionaba con Opus 5. Además, el effort que se aplica cuando no indicas ninguno baja de high a medium. Si cambias de modelo solo por el precio, puedes toparte con errores o con un cambio de calidad del que ni te enteras. Este artículo contrasta el texto original de la documentación oficial con el del anuncio y repasa qué ha cambiado, cuánto cuesta y qué se rompe al migrar, en el orden en que te lo vas a encontrar.
Información a 24 de septiembre de 2026: escrito dos días después del lanzamiento, tras leer el texto original de la documentación de Claude Platform (resumen de modelos, la página de Opus 5.5, What's new, la guía de migración y los precios), el anuncio de Anthropic y la documentación y el CHANGELOG de Claude Code. Claude Sonnet 5.5 y Claude Haiku 5.5, que según el anuncio llegarán en las próximas semanas, aún no se habían publicado en ese momento.
Una bajada de precio y cuatro cambios que rompen código, todo a la vez
— Posicionado oficialmente como modelo para programación agéntica de larga duración y trabajo del conocimiento
1. Lo esencial de Opus 5.5: rendimiento, precio y riesgos de la migración
En la tabla comparativa de Anthropic obtiene puntuaciones por encima de Fable 5.1 en programación agéntica, trabajo del conocimiento y uso del ordenador. El propio anuncio lo sitúa a la par de Fable 5.1 en la mayoría de las tareas, y añade que a este nivel las diferencias en los benchmarks ya no son una guía fiable de las diferencias en la práctica.
Entrada y salida son un 20% más baratas que en Opus 5, a $4 / $20, y las lecturas de caché son un 60% más baratas, a $0.20. Frente a Sonnet 5, en cambio, entrada y salida cuestan el doble mientras que las lecturas de caché cuestan lo mismo. Qué significa «más barato» depende de la comparación.
Son cuatro: el thinking no se puede desactivar / forzar el uso de herramientas devuelve 400 / los bloques de thinking quedan ligados al modelo y a la conversación / desaparece la herramienta antigua de computer use. A eso se suma que el effort por defecto baja a medium y que el texto entre llamadas a herramientas pasa a los bloques de thinking.
En una frase, Opus 5.5 es «un Opus más barato que se maneja igual que Fable 5.1». En tres de los cuatro cambios que rompen código, la propia documentación oficial indica que también se aplican a Claude Fable 5.1. Si tu código ya pasó por una migración a Fable 5.1, te queda bastante menos por hacer.
2. Especificaciones y dónde está disponible
Empecemos por las cifras. La comparación incluye tres modelos: Opus 5, al que sustituye; Fable 5.1, el escalón superior; y Sonnet 5, el inferior.
| Elemento | Opus 5.5 | Opus 5 (Legacy) | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| ID del modelo en la API | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
claude-sonnet-5 |
| Precio (entrada/salida) | $4 / $20 | $5 / $25 | $10 / $50 | $2 / $10 |
| Contexto / salida máxima | 1M / 128K | 1M / 128K | 1M / 128K | 1M / 128K |
| Thinking | Siempre activo (no se puede desactivar) | Activo por defecto. Se puede desactivar con effort high o inferior | Siempre activo (no se puede desactivar) | Activo por defecto. Se puede desactivar con cualquier effort |
| Effort por defecto | medium | high | high | high |
| Corte de conocimiento fiable | Junio de 2026 | Mayo de 2026 | Junio de 2026 | Enero de 2026 |
| Velocidad (etiqueta relativa oficial) | Moderate | — | Slower | Fast |
| Retirada | No antes del 22 de septiembre de 2027 | No antes del 24 de julio de 2027 | No antes del 1 de septiembre de 2027 | No antes del 30 de junio de 2027 |
Fuentes: Anthropic, «Models overview», «Claude Opus 5.5», «Claude Opus 5», «Migrating to Claude Opus 5.5» (consultado el 24 de septiembre de 2026). La velocidad es una etiqueta relativa dentro de la gama actual y no aparece para Opus 5, que es Legacy. Las fechas de retirada son compromisos para las plataformas que opera Anthropic; Amazon Bedrock y Google Cloud fijan las suyas.
Lo que llama la atención de la tabla es que solo dos filas, «Thinking» y «Effort por defecto», difieren de Opus 5. El contexto y la salida máxima son idénticos, y el corte de conocimiento avanza apenas un mes. En la ficha técnica, lo que lo separa de Opus 5 es cómo se maneja y cuánto cuesta; la diferencia de rendimiento está en la tabla de la sección 4. Ten en cuenta también que, con la Message Batches API, añadir la cabecera beta output-300k-2026-03-24 eleva el límite de salida a 300K tokens (igual que en Opus 5).
Plataformas
Claude API (claude-opus-5-5), Amazon Bedrock (anthropic.claude-opus-5-5), Claude Platform on AWS, Google Cloud y Microsoft Foundry. Llegó a todas las plataformas el mismo día del lanzamiento.
claude.ai, las apps de iOS y Android, y Claude Code. En Claude Code pasó a ser el modelo por defecto en los planes principales, Pro incluido, a partir de la v2.1.280 (sección 9).
La variante rápida es una vista previa de investigación, y la documentación oficial la indica como exclusiva de la Claude API. No está disponible en Bedrock, Claude Platform on AWS, Google Cloud ni Microsoft Foundry.
3. Precio: más barato que Opus 5, pero depende de con qué lo compares
La página oficial What's new fija el precio en $4 / $20, por debajo de los $5 / $25 de Opus 5. Es el primer cambio en el precio de Opus después de que los $5 / $25 se mantuvieran desde Opus 4.5 hasta Opus 5 (comprobado en la tabla de la página oficial de precios). Estas son las tarifas en detalle.
| Por millón de tokens | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| Entrada | $4 | $5 | $10 | $2 |
| Salida | $20 | $25 | $50 | $10 |
| Escritura en caché (5 min) | $5 | $6.25 | $12.50 | $2.50 |
| Escritura en caché (1 hora) | $8 | $10 | $20 | $4 |
| Lectura de caché | $0.20 5% de la entrada |
$0.50 10% de la entrada |
$0.25 2.5% de la entrada |
$0.20 10% de la entrada |
| Batch API (entrada/salida) | $2 / $10 | $2.50 / $12.50 | $5 / $25 | $1 / $5 |
| Modo rápido (entrada/salida) | $8 / $40 | $10 / $50 | — | — |
Fuente: Anthropic, «Pricing» (consultado el 24 de septiembre de 2026). La fila del modo rápido solo incluye los modelos que figuran en la tabla del modo rápido de la página de precios. Los $2 / $10 de Sonnet 5 se introdujeron en el lanzamiento como precio promocional hasta el 31 de agosto y después pasaron a ser el precio estándar (según una nota de la misma página).
«Más barato» significa algo distinto frente a cada modelo
Comparado con Opus 5, es más barato en todas las partidas. Frente a Fable 5.1 o Sonnet 5, sin embargo, la diferencia no se reparte por igual entre partidas. El gráfico muestra la tarifa de Opus 5.5 tomando como 100 la del otro modelo.
Tarifa de Opus 5.5 con la del otro modelo = 100
Fuente: cálculo de este artículo a partir de las tarifas de «Pricing» de Anthropic (la longitud de las barras está escalada para que 200 ocupe todo el ancho)
Tres conclusiones:
- Si vienes de Opus 5, cuanto más peso tenga la caché en tu carga de trabajo, más ahorras. Entrada y salida bajan un 20%, y las lecturas de caché un 60%. El propio anuncio señala que las lecturas de caché suponen la mayor parte del coste del trabajo agéntico y de programación.
- Frente a Fable 5.1, la diferencia en lecturas de caché es pequeña. Entrada y salida cuestan el 40% del precio de Fable 5.1, pero las lecturas de caché son $0.20 frente a $0.25, apenas un 20% de diferencia.
- Frente a Sonnet 5, solo las lecturas de caché cuestan lo mismo. Entrada y salida son el doble de caras, pero las lecturas de caché cuestan $0.20 en ambos, así que la diferencia de precio se estrecha a medida que crece la proporción de tokens en caché.
Ejemplo práctico: una tarea con 10M tokens de lectura de caché, 500K de entrada y 300K de salida (los recuentos de tokens son una suposición de este artículo; no se incluye el coste de escritura en caché)
- Opus 5.5: $2.00 + $2.00 + $6.00 = $10.00
- Opus 5: $5.00 + $2.50 + $7.50 = $15.00 (Opus 5.5 cuesta dos tercios de esto)
- Fable 5.1: $2.50 + $5.00 + $15.00 = $22.50
- Sonnet 5: $2.00 + $1.00 + $3.00 = $6.00 (Opus 5.5 cuesta unas 1.7 veces más, no el doble)
Esto compara tarifas con el mismo número de tokens; en la práctica, cada modelo consume una cantidad distinta. Tarifas tomadas de «Pricing» de Anthropic.
Un punto más: la tarifa por token y la factura son dos cosas distintas. El anuncio de Anthropic afirma que, con la configuración por defecto, cuesta un 40% menos que Opus 5 en el trabajo habitual, porque el precio por token es menor y además usa menos tokens por tarea. Es una medición de la propia Anthropic. Por otro lado, la documentación oficial también dice que con el mismo effort, Opus 5.5 tiende a pensar más por turno que Opus 5, sobre todo en xhigh y max. Los tokens de thinking se facturan como tokens de salida aunque no se muestren. Las cargas de trabajo que en Opus 5 abaratabas desactivando el thinking no pueden desactivarlo en Opus 5.5, así que los tokens de salida pueden aumentar. Tras migrar, la única forma de saberlo es medir usage y volver a comparar con tu propia carga de trabajo. Los precios de todos los modelos de Claude están en nuestra comparativa de precios de Opus, Sonnet y Haiku.
4. Benchmarks: comparando solo dentro de la tabla de Anthropic
El anuncio de Opus 5 mostraba su tabla comparativa como imagen, pero este anuncio usa una tabla de texto en la propia página. Tiene cinco columnas: Opus 5.5, Fable 5.1, Opus 5, GPT-6 Astra y GPT-5.6 Sol. Primero, las condiciones de la tabla:
- Salvo que se indique lo contrario, Opus 5.5 se midió con el effort máximo (max). La única excepción es Terminal-Bench 4.0: Opus 5.5 en xhigh y GPT-6 Astra en high (cifra comunicada por OpenAI), la mejor puntuación de cada modelo
- Las cifras de GPT-6 Astra y GPT-5.6 Sol en Terminal-Bench 4.0, y la de GPT-6 Astra en Terminal-Bench-Science 0.1, son cifras comunicadas por OpenAI. Para las cifras de GPT del resto de filas no se indica quién las midió
- Las cifras de AutomationBench las ejecutó y comunicó Zapier (Opus 5.5 procede de la evaluación de acceso anticipado de Zapier; Opus 5 y los dos modelos GPT, de su clasificación pública). Es la única fila en la que la tabla dice explícitamente que midió un tercero
- Opus 5.5 se midió con las mismas salvaguardas activadas que en producción. En los problemas en los que intervino una salvaguarda, los resolvió Opus 4.8 en el caso de ciberseguridad, y Opus 5 en biología y desarrollo de LLM de frontera. Anthropic señala que esto probablemente rebaja las puntuaciones de Opus 5.5
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 Programación agéntica en la terminal |
66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1 (Main) Si los cambios llegan a fusionarse |
54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0 Tareas ambiguas en varios archivos |
57.8% | 51.8% | 46.6% | — | 41.7% |
| GDPval-AA v2.1 (Elo) Trabajo real en 44 ocupaciones |
1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench Flujos de trabajo empresariales (medido por Zapier) |
40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Humanity's Last Exam Razonamiento multidisciplinar (con herramientas) |
67.7% | 65.6% | 63.6% | 57.2% | — |
| Terminal-Bench-Science 0.1 Investigación científica agéntica |
58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0 Uso del ordenador (marcado como «partial» en la tabla) |
81.8% | 80.7% | 74.0% | — | — |
| Chartography Lectura de gráficos (con herramientas) |
89.0% | 88.4% | 83.4% | — | — |
Fuente: tabla comparativa de «Introducing Claude Opus 5.5» de Anthropic (22 de septiembre de 2026; consultado el 24 de septiembre). Verde significa que Opus 5.5 tiene la mejor puntuación de esa fila; rojo, que en esa fila la misma tabla recoge una puntuación superior a la de Opus 5.5. «—» indica que la tabla no da valor.
Opus 5.5 tiene la mejor puntuación en 7 de las 9 filas. Las ventajas más amplias están en Terminal-Bench 4.0 (10.6 puntos por delante de Fable 5.1) y GDPval-AA v2.1 (111 puntos por delante de Fable 5.1). Frente al anterior Opus 5, Terminal-Bench-Science 0.1 pasó del 29.0% al 58.7%, aproximadamente el doble.
Puntuaciones por nivel de effort, según las descripciones de los gráficos del anuncio
Los valores de la tabla son en max (xhigh en Terminal-Bench 4.0), pero el anuncio incluye además gráficos que representan la puntuación frente al coste por tarea en cada nivel de effort, y sus descripciones dan cifras con el ajuste por defecto, medium.
54.6% en medium. Supera la mejor puntuación de GPT-6 Astra (53.3%) con aproximadamente una quinta parte del coste por tarea. La puntuación en medium es superior a la de max que recoge la tabla (54.4%).
52.5% en medium. Por encima de Fable 5.1 (max), con 51.8%, y de Opus 5 (max), con 46.6%, y supera en 11 puntos la mejor puntuación de GPT-5.6 Sol (41.7%) con aproximadamente un tercio del coste.
Con el effort por defecto, supera a Opus 5 en max con aproximadamente una quinta parte del coste. Iguala a GPT-6 Astra con cerca del 40% del coste.
En medium, supera a GPT-6 Astra en max con aproximadamente una quinta parte del coste por tarea.
Fuente: descripciones de los gráficos de «Introducing Claude Opus 5.5» de Anthropic (todas las mediciones y comparaciones son de la propia Anthropic)
FrontierCode merece una pausa. Dentro del mismo anuncio, medium (54.6%) supera ligeramente a max (54.4%). El patrón que se viene viendo desde Opus 5, en el que subir el effort no siempre sube la puntuación, continúa con Opus 5.5 (sección 6). El anuncio y las cifras de GPT-6 Astra están en nuestro análisis del lanzamiento de GPT-6 Astra.
5. Dónde no gana y cómo leer la tabla
La cobertura de un lanzamiento suele enumerar solo las filas que gana el modelo, así que aquí va la otra cara. Todo lo que sigue procede del propio anuncio y de la documentación de Anthropic.
En la propia tabla de Anthropic, GPT-6 Astra queda por delante en AutomationBench, 40.0% frente a 41.4%, y en Terminal-Bench-Science 0.1, 58.7% frente a 64.6%. Ten en cuenta que AutomationBench se ejecutó sin modelo de reserva y que las intervenciones de las salvaguardas se contaron como fallos (según la nota de la tabla).
Alegando unas capacidades cibernéticas muy elevadas, el anuncio indica que aplica salvaguardas cercanas a las de Fable 5.1 y deriva la mayor parte del trabajo de ciberseguridad a Opus 4.8. Encontrar y corregir errores en el desarrollo cotidiano sigue funcionando con normalidad.
La biología recibe las mismas salvaguardas que en Fable 5.1. Para usarlo en investigación y desarrollo hay que solicitar el acceso al Life Sciences Verification Program, pensado para organizaciones verificadas.
Dos cosas que conviene tener presentes al leer la tabla: la primera, que el propio anuncio reconoce que a este nivel de rendimiento las diferencias en los benchmarks empiezan a ser una guía poco fiable de las diferencias reales, y que en el uso interno de Anthropic la distancia con Fable 5.1 se percibe menor de lo que sugieren las cifras. Mejor no leer «10 puntos por delante de Fable 5.1» como 10 puntos de diferencia en la práctica. La segunda, que las versiones de las pruebas no coinciden con las de la tabla del anuncio de Opus 5 (CursorBench 3.2 → 4.0, GDPval-AA v2 → v2.1, etc.). Si tomas cifras de la tabla de julio y de esta y las pones lado a lado, estás comparando valores medidos en condiciones distintas.
6. Qué implica que el effort por defecto pase a medium
Este es el cambio que más fácilmente pasa desapercibido. Una petición que no indica effort se ejecuta en high con Opus 5 y en medium con Opus 5.5. Con exactamente el mismo código, el modelo piensa un nivel menos a fondo.
La página oficial de effort dice que fijar explícitamente el valor por defecto (medium en Opus 5.5) se comporta exactamente igual que omitir el effort. Si quieres la misma profundidad que en Opus 5, indica high de forma explícita.
Con el mismo effort, Opus 5.5 tiende a pensar más por turno que Opus 5, sobre todo en xhigh y max (What's new). Trasladar el high de Opus 5 no garantiza obtener el mismo resultado.
Como el thinking no se puede apagar, el effort es lo único que regula cuánto piensa el modelo y cuánto cuesta. Donde en Opus 5 desactivabas el thinking, baja el effort.
Entonces, ¿qué nivel usar? Este es el criterio de la documentación oficial, resumido para Opus 5.5.
| effort | Indicado para (descripción oficial) | Notas para Opus 5.5 |
|---|---|---|
| low | Tareas sencillas en las que priman la velocidad y el coste, como los subagentes | Candidato para sustituir las cargas de trabajo que desactivaban el thinking en Opus 5 |
| medium (por defecto) | Trabajo agéntico que necesita equilibrar velocidad, coste y rendimiento | El nivel que superó las mejores puntuaciones de la competencia en FrontierCode y CursorBench en los gráficos del anuncio |
| high | Razonamiento complejo, programación difícil y trabajo agéntico | El valor por defecto de Opus 5. Una referencia cómoda para comparar justo después de migrar |
| xhigh | Programación agéntica de larga duración | Empieza con max_tokens en 64K tokens y ajusta a partir de ahí (guía de migración) |
| max | Problemas difíciles que exigen el razonamiento más profundo | La documentación de Claude Code advierte de que las mejoras tienden a estancarse y de que es propenso a pensar de más, así que pruébalo antes de usarlo de forma general |
Fuentes: Anthropic, «Effort», la guía de migración, Claude Code, «Model configuration»
El consejo oficial es coherente: no arrastres la configuración del modelo anterior; vuelve a ajustar el effort con tu propio conjunto de evaluación. El anuncio recoge también testimonios de empresas que lo probaron antes del lanzamiento, como el de Deloitte, que asegura que incluso con el effort más bajo encontró más errores conocidos que Opus 5 en high, pero son resultados que cada empresa midió con su propio trabajo y que Anthropic eligió publicar; nada garantiza que tu carga de trabajo se comporte igual. Comprueba con tu propio trabajo si medium aguanta en calidad y qué mejora al subir a high. En Opus 5.5 también puedes cambiar el effort mensaje a mensaje en mitad de la conversación sin romper la caché del prompt (beta).
7. Cuatro cosas que se rompen al pasar desde Opus 5, y cómo arreglarlas
La página oficial What's new in Claude Opus 5.5 enumera cuatro cambios que rompen compatibilidad y afectan al código que funciona con Opus 5. Todos devuelven un 400 invalid_request_error.
① El thinking no se puede desactivar
Opus 5 aceptaba thinking: {"type": "disabled"} con effort high o inferior. En Opus 5.5, el thinking está siempre activo, y tanto disabled como un presupuesto manual, {"type": "enabled", "budget_tokens": N}, devuelven error con cualquier nivel de effort. El mensaje que recibes es:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
Solución: elimina el parámetro thinking (entonces se trata igual que {"type": "adaptive"}). Donde desactivabas el thinking para ahorrar, baja el effort.
# Antes: funciona con Opus 5, devuelve 400 con Opus 5.5 client.messages.create( model="claude-opus-5", max_tokens=16000, thinking={"type": "disabled"}, messages=[...], ) # Después: el thinking siempre está activo; el effort fija cuánto client.messages.create( model="claude-opus-5-5", max_tokens=16000, output_config={"effort": "low"}, messages=[...], )
Como el thinking siempre se ejecuta, una respuesta puede empezar con un bloque de thinking. El código que lee por posición, como content[0].text, se romperá, así que selecciona los bloques cuyo type sea "text". En los bucles de uso de herramientas, devuelve los bloques de thinking intactos, aunque estén vacíos (editarlos, reordenarlos o quitar alguno devuelve 400). max_tokens limita el thinking y la respuesta en conjunto, así que hay que revisar el límite de las cargas de trabajo que tenían el thinking desactivado.
② Forzar el uso de herramientas devuelve error
Poner tool_choice en {"type": "any"} o {"type": "tool", "name": "..."} devuelve 400. La API de recuento de tokens aplica la misma comprobación. Solo se admiten auto (el valor por defecto) y none.
tool_choice: type "tool" and "any" are not supported for this model.
Solución: deja tool_choice en auto y añade strict: true a las definiciones de las herramientas (strict tool use), o lleva el esquema a structured outputs. Después, indica en el prompt cuándo debe usarse la herramienta. Si forzabas el uso de herramientas solo para garantizar una salida JSON, pasar a structured outputs es el camino más limpio. Una advertencia: strict tool use solo admite un subconjunto de JSON Schema, y cada objeto del esquema necesita additionalProperties: false.
# Después: auto + strict; di con palabras cuándo usar la herramienta client.messages.create( model="claude-opus-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "¿Qué tiempo hace en París? Usa la herramienta get_weather."}], )
③ Los bloques de thinking quedan ligados al modelo y a la conversación
Cada bloque de thinking registra qué modelo lo generó. Opus 5.5 puede leer los bloques de thinking de los modelos Opus, Sonnet y Haiku hasta Opus 5, pero no los de Fable ni Mythos. En sentido contrario, solo Fable 5.1 y Mythos 5.1 en la Claude API pueden leer los bloques de thinking de Opus 5.5.
- Pasar de Opus 5 → Opus 5.5, o de Opus 5.5 → Fable 5.1 (Claude API) conserva el razonamiento anterior
- Cualquier otro cambio (por ejemplo, Opus 5.5 → Sonnet 5) hace que los turnos posteriores se ejecuten sin el razonamiento del modelo anterior. La petición en sí funciona, y los bloques descartados no se facturan
Además, la API comprueba que nada de lo que precede a un bloque de thinking de Opus 5.5 (system, tools, mensajes anteriores) haya cambiado desde que se creó el bloque. En las cuentas creadas a partir del 31 de agosto de 2026 a las 00:00 (UTC), esto se aplica por defecto, y enviar bloques sobre un historial que reescribiste a mitad de conversación devuelve 400.
Solución: haz avanzar la conversación solo añadiendo al final. Cuando quieras cambiar instrucciones o herramientas, usa un mensaje de sistema a mitad de conversación en lugar de reescribir el historial. Según la guía de migración, Claude Code, claude.ai, Claude Managed Agents y el Claude Agent SDK ya funcionan solo añadiendo, así que si construyes sobre ellos no hay que cambiar nada. Si no puedes evitar reescribir, añade la cabecera beta thinking-binding-controls-2026-08-01 y pon thinking.block_binding.prefix_mismatch_behavior en "drop_block" para que los bloques afectados se descarten en lugar de dar error. El mecanismo es el mismo que en Fable 5.1, que explicamos en detalle en nuestro artículo sobre los cambios que rompen compatibilidad en Fable 5.1.
④ La herramienta antigua de computer use no está disponible en la Claude API ni en Google Cloud
Opus 5 aceptaba computer use tanto con el nuevo conjunto de herramientas computer_toolset_20260801 como con la herramienta antigua computer_20251124 y una cabecera beta. Opus 5.5 en la Claude API y en Google Cloud solo acepta el conjunto de herramientas, y declarar la herramienta antigua devuelve 400. El mensaje empieza así:
'claude-opus-5-5' does not support tool types: computer_20251124.
Solución: quita la cabecera beta y sustituye tools por [{"type": "computer_toolset_20260801"}] (sin nombre ni tamaño de pantalla). El bucle del agente también necesita cambios, en tres puntos: el tipo de acción está en el name del bloque, no en input.action; un solo turno puede contener varias acciones; y cada resultado debe devolverse con toolset_name. En Amazon Bedrock la herramienta antigua sigue funcionando con Opus 5.5, así que ahí no hace falta cambiar nada.
8. Cambios que llegan sin ningún error
Los cuatro cambios que rompen compatibilidad devuelven un 400, así que los notarás. Los delicados son los cambios en los que solo varía el comportamiento, sin ningún error.
| Cambio | Qué ocurre / qué hacer |
|---|---|
| El texto entre llamadas a herramientas pasa a los bloques de thinking | Frases cortas como «Ahora voy a comprobar X», que en Opus 5 eran bloques de texto, llegan ahora como bloques de thinking de progreso. Con el ajuste de visualización por defecto (display: "omitted") vienen vacías, así que las interfaces que mostraban el progreso al usuario se quedan en silencio entre llamadas a herramientas. Pon display en "updates" (beta, cabecera thinking-display-updates-2026-08-18; devuelve solo el progreso y mantiene oculto el razonamiento) o en "summarized" (devuelve resúmenes del razonamiento mezclados con el progreso), y muestra los bloques de thinking no vacíos antes del tool_use que los sigue |
| Más categorías de rechazo | Ahora funciona un clasificador de biología junto al de ciberseguridad, y las peticiones que intentan que el modelo vuelque su razonamiento interno en la respuesta pueden rechazarse como reasoning_extraction. Un rechazo llega como HTTP 200 con stop_reason: "refusal", así que lee stop_details para gestionarlo. El fallback del lado del servidor (fallbacks: "default", beta) no reintenta en caso de reasoning_extraction |
| Lectura más precisa de gráficos y figuras | Ahora lee con precisión imágenes con gráficos muy detallados o contenido que depende de la maquetación, incluso sin herramientas. Los apaños en el prompt que añadiste para modelos anteriores pueden dejar de ser necesarios (aunque añadir herramientas sigue mejorando la precisión con las entradas más detalladas) |
| Si vienes de Opus 4.8: sin Priority Tier | Opus 4.8 admite Priority Tier, pero Opus 5.5 no. Las organizaciones con contrato tienen que planificar la capacidad por separado |
Fuentes: What's new in Claude Opus 5.5, Migrating to Claude Opus 5.5
9. Qué cambia en Claude Code y en claude.ai
Esta es la parte que importa si no llamas a la API directamente. Claude Code añadió compatibilidad con Opus 5.5 en la v2.1.280 del CHANGELOG.
default equivale ahora a Opus 5.5 en Pro, Max, Team, Enterprise y la API. Pro y Team Standard usaban antes Sonnet 5 por defecto, así que para ellos es un paso de Sonnet a Opus. El alias opus también apunta a Opus 5.5 en la Claude API, Claude Platform on AWS, Bedrock y Google Cloud. Las versiones anteriores a la v2.1.280 no pueden usarlo, así que ejecuta claude update.
Opus 5.5 arranca en medium. El nivel de effort que guardaste con /effort en tiempos de Opus 5 no se traslada (ni el ajuste guardado por modelo ni el antiguo effortLevel de nivel superior en la configuración de usuario se aplican a Opus 5.5). Funciona en medium hasta que vuelvas a elegir en /effort o en la pantalla de /model. La variable de entorno CLAUDE_CODE_EFFORT_LEVEL y un effortLevel definido en la configuración del proyecto o en la configuración gestionada se aplican a todos los modelos.
Alt+T (Option+T en macOS), alwaysThinkingEnabled y MAX_THINKING_TOKENS=0 no tienen ningún efecto en Opus 5.5 ni en Fable. Desde la v2.1.281, en los modelos cuyo thinking no se puede apagar, Claude Code muestra una explicación de una línea en lugar de alternar el ajuste.
Cuando salta un clasificador, las peticiones de biología se vuelven a ejecutar con Opus 5 y las de ciberseguridad con Opus 4.8, y la sesión se queda en ese modelo. Usa /model para volver. La documentación oficial dice que en pruebas de penetración, CTF o bases de código con mucha biología, esto suele ocurrir ya desde la primera petición.
Fuentes: Claude Code, «Model configuration» y el CHANGELOG (v2.1.280 y v2.1.281, consultado el 24 de septiembre de 2026)
Cómo guarda Claude Code el effort se explica en nuestra guía del ajuste de effort, y cómo funciona el propio thinking, en thinking adaptativo frente a thinking extendido. Según el anuncio de Anthropic, el modo rápido (hasta 2.5 veces más rápido, $8 de entrada / $40 de salida) también está disponible en Claude Code.
claude.ai y las apps
Opus 5.5 se puede seleccionar en claude.ai y en las apps de iOS y Android desde el día del lanzamiento (Anthropic publicó un system prompt de Opus 5.5 con fecha de ese mismo día). El anuncio también dice que, junto con la bajada de precio, ampliará los límites de uso de cinco horas de Pro, Max, Team y Enterprise por puestos, y que dará a los suscriptores un reinicio del límite de uso para usar cuando quieran. El anuncio no concreta cuánto suben los límites. Los precios por plan están en nuestra comparativa de precios de Claude y ChatGPT.
10. Cómo elegir entre Opus 5.5, Fable 5.1, Sonnet 5 y Opus 5
La orientación del resumen oficial de modelos es breve: si dudas, empieza por Opus 5.5; usa Fable 5.1 para razonamiento exigente y trabajo agéntico de larga duración, o cuando Opus 5.5 se quede corto tras evaluarlo con effort alto. Si le sumas el precio y las restricciones de la API, la elección queda así.
- Quieres decidirte primero por un solo modelo (el punto de partida oficial)
- Programación agéntica de larga duración y trabajo del conocimiento
- Usas Opus 5 (más barato en todas las tarifas)
- El coste de Fable 5.1 te pesa y quieres comprobar si Opus 5.5 basta
- La calidad sigue sin llegar tras evaluar Opus 5.5 en high o superior
- Razonamiento exigente, trabajo agéntico muy largo
- Con mucho peso de la caché, la diferencia de tarifa es menor que en entrada/salida ($0.25 frente a $0.20)
- Necesitas velocidad o mucho volumen (etiqueta oficial de velocidad: «Fast»)
- Quieres desactivar el thinking o seguir forzando el uso de herramientas
- Entrada y salida cuestan la mitad que en Opus 5.5 (las lecturas de caché cuestan lo mismo)
- Su sucesor, Sonnet 5.5, está anunciado para las próximas semanas
- Como solución provisional hasta que hayas resuelto los cuatro problemas de la sección 7
- Es Legacy pero sigue disponible, con retirada no antes del 24 de julio de 2027
- Todas sus tarifas son más altas que las de Opus 5.5, así que hay pocos motivos para quedarse mucho tiempo
Si dudas, el orden es sencillo: ① prueba Opus 5.5 en medium y en high con tu propio trabajo → ② si no basta, prueba xhigh → ③ si sigue sin bastar, pasa a Fable 5.1 → y si medium resulta más que suficiente, comprueba si low o Sonnet 5 también sirven. Subir el effort y subir de modelo son dos formas de pagar por calidad, y cuál de las dos sale más barata para la mejora que obtienes depende del trabajo.
11. Pasos de migración (para quien usa la API)
De la lista de comprobación de la guía de migración, estos son los puntos que aplican al pasar desde Opus 5, en el orden en que los harías. Claude Code dispone además de /claude-api migrate para ayudarte (un skill incluido que menciona la guía de migración; confirma el alcance contigo antes de editar).
- Cambia el ID del modelo de
claude-opus-5aclaude-opus-5-5(anthropic.claude-opus-5-5en Bedrock) - Quita
disabledyenabled(con presupuesto) dethinking, y elige un effort en su lugar - Indica el effort de forma explícita (omitirlo equivale a medium; usa
highpara la misma profundidad que en Opus 5) - Sustituye
anyytoolentool_choiceporautomás strict tool use, o por structured outputs - Si usas computer use en la Claude API o en Google Cloud, pasa a
computer_toolset_20260801y ajusta el bucle - Lee las respuestas seleccionando los bloques por
typey, en los bucles de herramientas, devuelve los bloques de thinking intactos - Si muestras el progreso en una interfaz, pon
displayen"updates"o"summarized" - Si reescribes
system,toolso mensajes anteriores a mitad de conversación, pasa a un patrón de solo añadir - Si enrutas peticiones a otros modelos, prueba partiendo de que el razonamiento de Opus 5.5 no se trasladará
- Gestiona
stop_reason: "refusal"y configura los fallbacks - Revisa
max_tokensen las cargas de trabajo que tenían el thinking desactivado (empieza en 64K para xhigh y max) - Vuelve a medir el coste y la latencia con el effort que hayas elegido
Fuente: puntos de la sección «Every starting model» de Anthropic, «Migrating to Claude Opus 5.5», reordenados según el orden de trabajo
Si vienes directamente de Opus 4.8 o anterior, además tienes que contar con que el thinking ahora se ejecuta en peticiones que nunca lo pedían. Merece la pena revisar también los pasos de migración de nuestro análisis del lanzamiento de Opus 5.
Conclusiones
Claude Opus 5.5 es un lanzamiento en el que una bajada de precio y un cambio en la forma de manejar el modelo llegan juntos. Las tarifas bajan un 20% en entrada y salida y un 60% en lecturas de caché, y en la propia tabla comparativa de Anthropic supera a Fable 5.1 en muchas filas. Por otro lado, el thinking ya no se puede apagar, y forzar el uso de herramientas, la herramienta antigua de computer use y reescribir el historial provocan ahora errores 400.
Y la bajada del effort por defecto a medium es fácil de pasar por alto precisamente porque no produce ningún error. En la API, indica el effort de forma explícita; en Claude Code, comprueba que tu configuración de Opus 5 no ha dejado de aplicarse sin avisar. Si de verdad sale más barato es algo que se mide con usage, no con las tarifas por token.
Por último, las cifras de los benchmarks son valores medidos en esa tabla y en esas condiciones. En AutomationBench y Terminal-Bench-Science, GPT-6 Astra queda por encima en la misma tabla, y la propia Anthropic dice que la distancia con Fable 5.1 es menor de lo que sugieren las cifras. Empieza comparando medium y high con tu propio trabajo.
Preguntas frecuentes
P. ¿Opus 5.5 es más barato que Opus 5?
R. Las tarifas por token son más bajas en todas las partidas ($4 de entrada, $20 de salida y $0.20 de lectura de caché, frente a $5, $25 y $0.50 en Opus 5). Anthropic afirma que es un 40% más barato en el trabajo habitual con la configuración por defecto, pero es una medición propia. Las cargas de trabajo que se ejecutaban con el thinking desactivado pueden generar más tokens de salida, así que revisa usage después de migrar.
P. ¿Hay alguna forma de apagar el thinking?
R. No. En la API, enviar disabled devuelve 400, y el Alt+T de Claude Code y los ajustes similares no tienen efecto. Para reducir cuánto piensa, pon el effort en low. Si de verdad necesitas el thinking apagado, la opción es Sonnet 5, que permite desactivarlo con cualquier effort.
P. He cambiado el ID del modelo y ahora recibo un error 400.
R. El mensaje de error te dice cuál es. "thinking.type.disabled" o "thinking.type.enabled" apuntan al ajuste de thinking, tool_choice: type "tool" and "any" a forzar el uso de herramientas y computer_20251124 a la herramienta antigua de computer use. Si no es ninguno de estos y reescribes el historial a mitad de conversación, sospecha de la comprobación de los bloques de thinking (sección 7, ③).
P. En Claude Code, parece que no se aplica el effort que tenía con Opus 5.
R. Es intencionado. El effort guardado con /effort se almacena por modelo, y ni el ajuste de Opus 5 ni el antiguo effortLevel de nivel superior en la configuración de usuario se aplican a Opus 5.5. Opus 5.5 arranca en medium. Vuelve a elegirlo con /effort y quedará guardado como ajuste por modelo para Opus 5.5.
P. Mi agente personalizado ya no muestra el progreso mientras trabaja.
R. En Opus 5.5, el texto entre llamadas a herramientas llega en bloques de thinking, que vienen vacíos con el ajuste de visualización por defecto. Pon thinking.display en "updates" (beta) o en "summarized" y muestra los bloques de thinking que no estén vacíos.
* Las cifras de este artículo se basan en el anuncio oficial de Anthropic «Introducing Claude Opus 5.5» (los benchmarks proceden de la tabla comparativa y de las descripciones de los gráficos de esa página), en la documentación oficial «Models overview», «Claude Opus 5.5», «What's new in Claude Opus 5.5», «Migrating to Claude Opus 5.5» y «Pricing», y en «Model configuration» y el CHANGELOG de Claude Code (todo consultado el 24 de septiembre de 2026). Las especificaciones y los precios pueden cambiar, así que confirma los detalles definitivos en la documentación oficial.
Artículos relacionados: Análisis del lanzamiento de Claude Opus 5, Cambios que rompen compatibilidad en Claude Fable 5.1 y cómo migrar.