Índice
- 1. Lo esencial de Sonnet 5.5: rendimiento, precio y riesgos de la migración
- 2. Especificaciones y dónde está disponible
- 3. Precio: igual que Sonnet 5, salvo el mínimo de la caché
- 4. Benchmarks: comparando solo dentro de la tabla de Anthropic
- 5. Cinco cambios incompatibles que dan error 400 al pasar desde Sonnet 5, y cómo arreglarlos
- 6. Cambios que llegan sin ningún error
- 7. El effort por defecto: high en la API, medium en Claude Code
- 8. Cómo elegir entre Sonnet 5.5, Opus 5.5 y Haiku
- 9. Usarlo en Claude Code y GitHub Copilot
- 10. Pasos de migración (para quien usa la API)
- Conclusiones
- Preguntas frecuentes
El 28 de septiembre de 2026, Anthropic lanzó Claude Sonnet 5.5. Según el anuncio, es «el segundo modelo de la familia Claude 5.5», seis días después de Opus 5.5, y el anterior Sonnet 5 (lanzado el 30 de junio de 2026) ha pasado a Legacy (modelo antiguo que se puede seguir usando). En la lista oficial de modelos se describe como «el modelo con la mejor combinación de velocidad e inteligencia».
Vamos directos a la conclusión. El precio es exactamente el mismo que el de Sonnet 5 ($2 de entrada, $10 de salida y $0,20 de lectura de caché por millón de tokens), y en la tabla comparativa de Anthropic mejora mucho respecto a Sonnet 5 en la mayoría de las filas. En cambio, el comportamiento de la API cambia: hay cinco cambios por los que el código que funcionaba con Sonnet 5 pasa a devolver un error 400. En concreto, ya no se puede usar thinking: {"type": "disabled"} para desactivar el thinking, y su sustituto, between_tools, solo se acepta con un effort de high o inferior. Este artículo contrasta la documentación oficial y el anuncio en su texto original y ordena, en el orden en que te harán falta en la práctica, qué ha cambiado, qué deja de funcionar al migrar y cómo elegir entre este modelo y Opus 5.5.
Información a 29 de septiembre de 2026: lo hemos escrito el día siguiente al lanzamiento, contrastando en su texto original la documentación oficial de Claude Platform (lista de modelos, la página de Sonnet 5.5, What's new, la guía de migración, precios, thinking, effort y caché de prompts), el anuncio de Anthropic, la documentación y el CHANGELOG de Claude Code y el changelog de GitHub. Claude Haiku 5.5, que el anuncio promete para «las próximas semanas», aún no se había publicado en esa fecha.
Mismo precio, cinco cambios incompatibles
— Posicionamiento oficial: «el modelo con la mejor combinación de velocidad e inteligencia»
1. Lo esencial de Sonnet 5.5: rendimiento, precio y riesgos de la migración
En la tabla comparativa de Anthropic supera a Sonnet 5 en todas las filas, y en GDPval-AA se queda a 2 puntos de Opus 5.5. Aun así, el propio anuncio dice que «en el trabajo complejo y abierto, Opus 5.5 sigue siendo claramente más fuerte».
Las tarifas son idénticas a las de Sonnet 5 en todas las partidas. Lo que cambia es la longitud mínima que se puede almacenar en caché, que baja de 1024 a 512 tokens. El anuncio dice que es «hasta un 30 % más barato por tarea», pero es una medición de la propia Anthropic.
Cinco: para desactivar el thinking hay que usar between_tools / el uso forzado de herramientas da 400 / los bloques de thinking quedan ligados al modelo y a la conversación / no se admite la antigua herramienta de computer use / combinaciones del advisor. Además, el texto entre llamadas a herramientas se devuelve en bloques de thinking.
En una frase, Sonnet 5.5 es un Sonnet que sube un escalón al mismo precio y que se maneja casi con las mismas reglas que Opus 5.5. Tres de los cinco cambios incompatibles (el uso forzado de herramientas, la vinculación de los bloques de thinking y la antigua herramienta de computer use) también existen en Opus 5.5 y en Fable 5.1. Lo propio de Sonnet 5.5 se reduce a dos cosas: que la forma de desactivar el thinking se mantiene como un valor distinto, between_tools, y las restricciones en las combinaciones de la herramienta advisor.
2. Especificaciones y dónde está disponible
Lo comparamos con tres modelos: Sonnet 5, al que sustituye; Opus 5.5, por encima, y Haiku 4.5, por debajo.
| Aspecto | Sonnet 5.5 | Sonnet 5 (Legacy) | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| ID del modelo en la API | claude-sonnet-5-5 |
claude-sonnet-5 |
claude-opus-5-5 |
claude-haiku-4-5-20251001 |
| Precio (entrada/salida) | $2 / $10 | $2 / $10 | $4 / $20 | $1 / $5 |
| Contexto / salida máxima | 1M / 128K | 1M / 128K | 1M / 128K | 200K / 64K |
| Thinking | Thinking adaptativo por defecto (el mínimo es between_tools) |
Thinking adaptativo por defecto (se desactiva con disabled) |
Thinking adaptativo siempre activo (no se puede desactivar) | Thinking extendido (con presupuesto) |
| Effort por defecto en la API | high | high | medium | No compatible |
| Fecha de corte de conocimiento fiable | Junio de 2026 | Enero de 2026 | Junio de 2026 | Febrero de 2025 |
| Longitud mínima para caché | 512 tokens | 1024 tokens | 512 tokens | 4096 tokens |
| Velocidad (indicación relativa oficial) | Rápido | — | Moderado | El más rápido |
| Retirada | No antes del 28 de septiembre de 2027 | No antes del 30 de junio de 2027 | No antes del 22 de septiembre de 2027 | No antes del 15 de octubre de 2026 |
Fuentes: Anthropic, «Models overview», «Claude Sonnet 5.5», «Claude Sonnet 5» y «Prompt caching» (comprobado el 29 de septiembre de 2026). La velocidad es una indicación relativa dentro de la gama actual y no figura para Sonnet 5, que es Legacy. La fecha de retirada es un compromiso para las plataformas que gestiona Anthropic; Amazon Bedrock y Google Cloud fijan las suyas por su cuenta.
Las únicas filas en las que difiere de Sonnet 5 son tres: «Thinking», «Fecha de corte de conocimiento» y «Longitud mínima para caché». El contexto, la salida máxima y el effort por defecto en la API son los mismos, y el tokenizador también es el de Sonnet 5, así que el mismo texto da el mismo número de tokens (What's new). En la Message Batches API, añadir la cabecera beta output-300k-2026-03-24 amplía el límite de salida hasta 300K tokens (igual que en Sonnet 5). Por cierto, enviar valores distintos de los predeterminados en temperature, top_p o top_k da 400. Esto ya pasaba con Sonnet 5, así que solo importa si migras directamente desde Sonnet 4.6 o anteriores.
Dónde está disponible
Claude API (claude-sonnet-5-5), Amazon Bedrock (anthropic.claude-sonnet-5-5), Claude Platform on AWS, Google Cloud y Microsoft Foundry. Llegó a todas las plataformas el mismo día del lanzamiento.
claude.ai y las apps de Claude (Anthropic ha publicado el prompt de sistema para Sonnet 5.5), Claude Code (v2.1.284 o posterior) y GitHub Copilot (Pro, Pro+, Max, Business y Enterprise).
El fast mode (versión rápida) solo figura en la página de precios para Opus 5.5, Opus 5 y Opus 4.8; Sonnet 5.5 no lo tiene. En Bedrock, Sonnet 5.5 no admite salidas estructuradas (incluido el strict tool use) (guía de migración).
3. Precio: igual que Sonnet 5, salvo el mínimo de la caché
El What's new oficial dice que tiene «el mismo precio que Sonnet 5, con las mismas tarifas de caché de prompts y de procesamiento por lotes». Estas son las tarifas en detalle.
| Por millón de tokens | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| Entrada | $2 | $2 | $4 | $1 |
| Salida | $10 | $10 | $20 | $5 |
| Escritura en caché (5 minutos) | $2,50 | $2,50 | $5 | $1,25 |
| Escritura en caché (1 hora) | $4 | $4 | $8 | $2 |
| Lectura de caché | $0,20 | $0,20 | $0,20 | $0,10 |
| Batch API (entrada/salida) | $1 / $5 | $1 / $5 | $2 / $10 | $0,50 / $2,50 |
Fuente: Anthropic, «Pricing» (comprobado el 29 de septiembre de 2026). La Batch API aplica un 50 % de descuento sobre la tarifa normal, tanto en entrada como en salida.
Dos cosas que pueden cambiar dentro del «mismo precio»
Que las tarifas sean iguales no significa que la factura vaya a serlo. Hay dos factores que pueden variar.
El primero es la longitud mínima para caché. Con Sonnet 5, los prompts de menos de 1024 tokens no se almacenaban en caché aunque llevaran cache_control. Con Sonnet 5.5, ese mínimo baja a 512 tokens. Por ejemplo, un proceso que envía cada vez un prompt de sistema más definiciones de herramientas de 800 tokens quedaba fuera de la caché con Sonnet 5, pero con Sonnet 5.5 sí se almacena. Puedes comprobar si se almacenó en el usage de la respuesta: si cache_creation_input_tokens y cache_read_input_tokens son ambos 0, no se almacenó (página oficial de Prompt caching). Quedarse por debajo del mínimo no da ningún error, así que merece la pena aprovechar la migración para buscar procesos en los que la caché no funcionaba sin que nadie lo notara.
El segundo es el número de tokens por tarea. El anuncio dice que «necesita muchos menos tokens para el mismo trabajo y, en las pruebas de Anthropic, es hasta un 30 % más barato por tarea» y que «genera la salida más de un 30 % más rápido que Sonnet 5». Es una medición de la propia Anthropic. Por otro lado, la documentación oficial dice que los niveles de effort se han «recalibrado», así que el mismo nivel no implica necesariamente pensar lo mismo que con Sonnet 5. Los tokens de thinking se facturan como tokens de salida aunque no se muestren. Tras migrar, la única forma de saberlo es medir el usage y volver a comparar con tu propio trabajo.
Ejemplo práctico: una tarea con 10M tokens de lectura de caché, 500K de entrada y 300K de salida (los recuentos de tokens son una suposición de este artículo; se omite el coste de escritura)
- Sonnet 5.5: $2,00 + $1,00 + $3,00 = $6,00 (lo mismo con Sonnet 5)
- Opus 5.5: $2,00 + $2,00 + $6,00 = $10,00 (unas 1,7 veces Sonnet 5.5, no el doble)
- Haiku 4.5: $1,00 + $0,50 + $1,50 = $3,00 (exactamente la mitad que Sonnet 5.5)
Es un cálculo de tarifas con el mismo número de tokens; en la práctica, cada modelo consume un número distinto. Tarifas según Anthropic, «Pricing».
La diferencia con Opus 5.5 no llega al «doble» porque la lectura de caché cuesta lo mismo, $0,20, también en Opus 5.5. Cuanto mayor sea la proporción de caché en un trabajo de agentes, menos te ahorras eligiendo Sonnet 5.5. Los precios de todos los modelos de Claude están resumidos en nuestra comparativa de precios de Opus, Sonnet y Haiku.
4. Benchmarks: comparando solo dentro de la tabla de Anthropic
La tabla comparativa del anuncio tiene cuatro columnas: Sonnet 5.5, Sonnet 5, Opus 5.5 y GPT-6 Sol. Primero, las condiciones de la tabla.
- La tabla es la del anuncio de Anthropic, y la mayoría de las filas son mediciones de Anthropic. La excepción: GDPval-AA v2.1 y AA-Briefcase v1.1 las ejecutó Artificial Analysis (nota 3 de la tabla).
- Esas mediciones de Artificial Analysis se hicieron en un entorno previo al lanzamiento que tenía un fallo capaz de degradar las respuestas a solicitudes con salidas estructuradas. Anthropic indica que «el efecto, si lo hubo, fue pequeño y en el sentido de rebajar las puntuaciones» y que el fallo ya está corregido.
- El Terminal-Bench 4.0 de Opus 5.5 es el valor en xhigh, la mejor puntuación de Opus 5.5 (nota 1). El FrontierCode de Sonnet 5.5 aparece con dos valores: 46.2% en max y 52.1% en xhigh (nota 2).
- Los valores de GPT-6 Sol en GDPval-AA, AA-Briefcase y Chartography llevan una nota de que podrían ser anteriores a que OpenAI corrigiera un fallo de comprensión de imágenes (nota 4).
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 Programación agéntica en la terminal |
70.6% | 10.3% | 66.4% (xhigh) | — |
| FrontierCode 1.1 (Main) Si el cambio se llega a fusionar |
52.1% (xhigh) 46.2% (max) |
42.4% | 54.4% | 49.3% |
| CursorBench 4.0 Tareas ambiguas en varios archivos |
55.5% | 34.1% | 57.8% | — |
| GDPval-AA v2.1 (Elo) Trabajo real de 44 profesiones (ejecutado por Artificial Analysis) |
1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 (Elo) Trabajo del conocimiento de larga duración (ejecutado por Artificial Analysis) |
1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam Razonamiento multidisciplinar (con herramientas) |
64.5% | 54.9% | 67.7% | — |
| OSWorld 2.1 Uso del ordenador (nota de la tabla: «partial») |
80.1% | 57.0% | 81.8% | — |
| Chartography Lectura de gráficos (sin herramientas) |
61.6% | 15.6% | 64.4% | 53.6% |
Fuente: tabla comparativa y notas de Anthropic, «Introducing Claude Sonnet 5.5» (28 de septiembre de 2026, comprobado el 29 de septiembre). En negrita, el valor más alto de cada fila. «—» indica que la tabla no da valor. Los detalles de medición están en la ficha del sistema (system card) de Sonnet 5.5 que enlaza el mismo anuncio.
Se desprenden tres cosas.
- La mejora respecto a Sonnet 5 es grande. Terminal-Bench 4.0 pasa de 10.3% a 70.6%, y Chartography (sin herramientas), de 15.6% a 61.6%: dentro de la misma tabla, se multiplican varias veces. En GDPval-AA sube unos 400 puntos.
- La distancia con Opus 5.5 es de pocos puntos en la mayoría de las filas. 2 puntos en GDPval-AA, 2,3 puntos en CursorBench y 1,7 puntos en OSWorld 2.1. En Terminal-Bench 4.0 supera incluso la mejor puntuación de Opus 5.5 (66.4% en xhigh).
- Aun así, Anthropic sitúa a Opus 5.5 por encima. El anuncio dice que «los benchmarks solo recogen una faceta de la capacidad. Tanto internamente como con evaluadores externos, Opus 5.5 sigue siendo claramente más fuerte en el trabajo complejo y abierto que exige mantener el criterio».
Coste según el effort: lo que dicen los textos de los gráficos del anuncio
El anuncio incluye también gráficos que comparan la puntuación y el coste por tarea en cada nivel de effort. Esto es lo que dicen sus textos explicativos.
En medium, el valor por defecto de las apps de Claude, supera con holgura la mejor puntuación de Sonnet 5 con menos de una décima parte del coste por tarea.
En high, el valor por defecto de Claude Platform, iguala la mejor puntuación de GPT-6 Sol con aproximadamente una quinta parte del coste por tarea. Frente a Sonnet 5 en el mismo nivel high, saca 10 puntos más con aproximadamente una quinceava parte del coste.
Incluso en low, el nivel más bajo, supera la mejor puntuación de Sonnet 5 con menos de una décima parte del coste por tarea.
En medium, supera la mejor puntuación de Sonnet 5 con aproximadamente una novena parte del coste por tarea.
Fuente: textos explicativos de los gráficos de Anthropic, «Introducing Claude Sonnet 5.5». Los gráficos de Terminal-Bench y CursorBench muestran GPT-5.6 Sol porque no se han publicado valores de GPT-6 Sol (nota de la misma página).
Aquí conviene fijarse en los dos valores de FrontierCode. En Sonnet 5.5, max (46.2%) puntúa menos que xhigh (52.1%). Según la nota del anuncio de Anthropic, en max el modelo recurría más a menudo a la skill de revisión de código de Claude Code y repartía el trabajo entre muchos subagentes, lo que en algunos casos llevó a agotar el tiempo o a editar fuera del alcance de la tarea. Subir el effort no siempre mejora el resultado, así que conviene decidir el nivel comparando con tu propio trabajo (sección 7). Las cifras de GPT-6 Sol se tratan en nuestro análisis del lanzamiento de GPT-6 Sol y Luna.
No lo mezcles con la tabla del anuncio de Opus 5.5: para el mismo Opus 5.5, Chartography aparece en el anuncio de Opus 5.5 con un 89.0% «con herramientas» y en esta tabla con un 64.4% «sin herramientas»: son valores con condiciones distintas. Si tomas cifras de los dos anuncios y las pones una al lado de otra, acabarás comparando valores medidos en condiciones diferentes. Si comparas, hazlo solo entre columnas de una misma tabla.
5. Cinco cambios incompatibles que dan error 400 al pasar desde Sonnet 5, y cómo arreglarlos
El documento oficial What's new in Claude Sonnet 5.5 enumera cinco cambios incompatibles (breaking changes) que afectan al código que funciona con Sonnet 5. En todos, el error es un 400 invalid_request_error.
① Para desactivar el thinking, between_tools en lugar de disabled
En Sonnet 5, thinking: {"type": "disabled"} desactivaba el thinking con cualquier effort. En Sonnet 5.5, disabled da 400, con este mensaje.
"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
En su lugar se usa thinking: {"type": "between_tools"}, el ajuste de thinking más bajo de este modelo, que detiene el «thinking previo» que el modelo hace de una vez antes de responder. En una solicitud que no usa herramientas, la respuesta queda solo con el texto, igual que con disabled en Sonnet 5. No necesita cabecera beta y funciona en todas las plataformas que ofrecen Sonnet 5.5. Pero si lo cambias pensando que equivale a disabled, tropezarás en tres puntos.
- Con effort xhigh y max da 400.
between_toolssolo se acepta con low, medium y high. Si con Sonnet 5 tenías procesos con «xhigh + thinking desactivado», tendrás que elegir entre bajar el effort a high o menos, o dejar de desactivar el thinking. - No se pueden enviar otros campos a la vez. Enviar
display,budget_tokensoblock_bindingjunto conbetween_toolsda 400. - No se puede cambiar el effort a mitad de conversación. Enviar un nivel distinto con el effort por mensaje (beta) da 400. Si quieres cambiar de nivel en cada turno, usa el thinking adaptativo (omite
thinkingo usa{"type": "adaptive"}).
Este es el ejemplo de antes y después de la guía de migración, en Python. Ojo: como el ejemplo de antes usa xhigh, el de después lo baja a high.
# Antes: funciona con Sonnet 5. Con Sonnet 5.5, 400 client.messages.create( model="claude-sonnet-5", max_tokens=16000, thinking={"type": "disabled"}, output_config={"effort": "xhigh"}, messages=[{"role": "user", "content": "..."}], ) # Después: detiene el thinking previo. Effort de high o inferior client.messages.create( model="claude-sonnet-5-5", max_tokens=16000, thinking={"type": "between_tools"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )
Incluso con between_tools, las notas breves de progreso que el modelo escribe entre llamadas a herramientas se devuelven en bloques de thinking con texto resumido. No los descartes: devuélvelos tal cual junto con el resto del turno del asistente. A partir de los bloques devueltos, el modelo recibe el texto completo de las notas que escribió (What's new). El presupuesto manual {"type": "enabled", "budget_tokens": N} sigue dando 400, igual que en Sonnet 5.
② El uso forzado de herramientas da error
Poner tool_choice en {"type": "any"} o {"type": "tool", "name": "..."} da 400. La API de recuento de tokens aplica la misma comprobación. Solo se admiten auto (por defecto) y none.
tool_choice: type "tool" and "any" are not supported for this model.
Solución: deja tool_choice en auto y añade strict: true a la definición de la herramienta (strict tool use), o traslada el esquema a salidas estructuradas. Con auto, el modelo puede responder con texto sin llamar a la herramienta, así que indica en el prompt «cuándo usar esa herramienta». El strict tool use solo admite un subconjunto de JSON Schema, y cada object del esquema necesita additionalProperties: false. En una solicitud se pueden marcar como strict hasta 20 herramientas, y los conjuntos de herramientas de MCP, computer use y browser use no admiten strict.
# Antes: funciona con Sonnet 5. Con Sonnet 5.5, 400 client.messages.create( model="claude-sonnet-5", max_tokens=1024, tools=tools, tool_choice={"type": "tool", "name": "get_weather"}, messages=[{"role": "user", "content": "What's the weather in Paris?"}], ) # Después: auto + strict. Cuándo usarla se indica en el texto client.messages.create( model="claude-sonnet-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}], )
En Amazon Bedrock la situación es distinta. Sonnet 5.5 en Bedrock no admite salidas estructuradas (incluido el strict tool use), así que envía auto sin strict, indica en el prompt cuándo llamar a la herramienta y valida la entrada de la herramienta con tu propio código (guía de migración).
③ Los bloques de thinking quedan ligados al modelo y a la conversación
Los bloques de thinking registran qué modelo los generó. Sonnet 5.5 puede leer los bloques de thinking de Sonnet 5, Opus 4.8, Haiku 4.5 y modelos anteriores, pero no los de Opus 5, Opus 5.5, Fable ni Mythos. Y ningún otro modelo puede leer los bloques de thinking de Sonnet 5.5.
- Al cambiar de Sonnet 5 → Sonnet 5.5, se conserva el razonamiento anterior.
- Al cambiar de Sonnet 5.5 → cualquier otro modelo, los turnos posteriores al cambio funcionan sin el razonamiento de Sonnet 5.5. La solicitud en sí tiene éxito, y los bloques descartados no se facturan.
Fable 5.1 y Mythos 5.1 pueden leer los bloques de thinking de Opus 5.5, pero los de Sonnet 5.5 no los puede leer nadie. Si tienes montado un enrutamiento que «sube de Sonnet 5.5 a Opus 5.5 solo las partes difíciles», compruébalo dando por hecho que el razonamiento de Sonnet 5.5 se pierde al subir.
Además, se comprueba que lo que va antes de un bloque de thinking de Sonnet 5.5 (system, tools y los mensajes anteriores) no haya cambiado después de generarse el bloque. En las cuentas creadas a partir del 31 de agosto de 2026 a las 0:00 (UTC), esto se aplica por defecto en la Claude API, Amazon Bedrock y Google Cloud, y enviar un historial reescrito a mitad de camino con esos bloques da 400.
Solución: avanza la conversación solo añadiendo. Si quieres cambiar las instrucciones o las herramientas, no reescribas el historial: usa mensajes de sistema a mitad de conversación (una función nueva en Sonnet 5.5 que Sonnet 5 no tenía). Si no puedes evitar reescribir, añade la cabecera beta thinking-binding-controls-2026-08-01 y pon thinking.block_binding.prefix_mismatch_behavior en "drop_block" para que, en lugar de dar error, descarte los bloques afectados. Pero block_binding solo funciona con thinking adaptativo, así que con between_tools, limítate a añadir o elimina tú mismo los bloques de thinking a partir del turno reescrito.
④ En la Claude API y Google Cloud no se admite la antigua herramienta de computer use
Sonnet 5 aceptaba el uso del ordenador (computer use) también con la antigua herramienta con cabecera beta computer_20251124. Sonnet 5.5 en la Claude API y Google Cloud solo admite el conjunto de herramientas computer_toolset_20260801, y declarar la herramienta antigua da 400. En la Claude API, el mensaje empieza así.
'claude-sonnet-5-5' does not support tool types: computer_20251124.
Solución: quita la cabecera beta, sustituye tools por [{"type": "computer_toolset_20260801"}] y adapta el bucle del agente a la forma del conjunto de herramientas (bloques tool_use de los miembros, varias acciones a la vez y toolset_name en los resultados). Si envías la cabecera beta fine-grained-tool-streaming-2025-05-14, quítala: enviarla junto con el conjunto de herramientas da 400, así que añade eager_input_streaming: true a cada herramienta que lo necesite. En Amazon Bedrock la herramienta antigua sigue funcionando, así que no hace falta cambiar nada.
⑤ Hay combinaciones no admitidas en la herramienta advisor
La herramienta advisor (beta) permite que el modelo ejecutor pida consejo a un modelo más potente. Cuando Sonnet 5.5 es el ejecutor, indicar como asesor Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5 o Sonnet 4.6 da 400. Solo se admiten Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 o Mythos 5.1.
Además, todos los asesores que admite Sonnet 5.5 devuelven el consejo cifrado en bloques advisor_redacted_result, así que el cliente no puede leer el texto del consejo. Los procesos que guardaban el contenido del consejo en registros o lo mostraban en pantalla tendrán que rehacerse. Combinaciones baratas como «Sonnet 5 de ejecutor y Opus 4.8 de asesor» no se pueden trasladar tal cual a Sonnet 5.5.
6. Cambios que llegan sin ningún error
Los cinco cambios incompatibles dan 400, así que los notarás. Los problemáticos son los que cambian el comportamiento sin dar ningún error.
| Cambio | Qué ocurre y qué hacer |
|---|---|
| El texto entre llamadas a herramientas pasa a bloques de thinking | Las notas de más de una o dos frases, como «Ahora voy a comprobar X», que en Sonnet 5 eran bloques de texto, se devuelven en bloques de thinking de progreso (las frases muy cortas siguen como texto). Con el valor por defecto display: "omitted" su contenido llega vacío, así que las interfaces que mostraban el progreso al usuario se quedan en silencio mientras duran las llamadas a herramientas. Con thinking adaptativo, pon display en "updates" (beta, cabecera thinking-display-updates-2026-08-18) o "summarized", y muestra los bloques de thinking no vacíos antes del tool_use que los sigue. Con between_tools, el texto llega sin ajustar nada. |
| Los niveles de effort se han recalibrado | El mismo nivel no implica necesariamente pensar lo mismo que con Sonnet 5. La documentación oficial dice que «no arrastres la configuración: vuelve a ajustar el effort» (sección 7). |
| Ahora hay cinco categorías de rechazo | cyber, bio, frontier_llm, reasoning_extraction y general_harms. Un rechazo devuelve HTTP 200 con stop_reason: "refusal", así que hay que leer stop_details y gestionarlo. El respaldo del lado del servidor (fallbacks: "default", beta, solo en la Claude API) reintenta con Sonnet 5 únicamente cyber y frontier_llm. |
| Los bloques de thinking quedan ligados a la cuenta que los creó | Los bloques de thinking de Sonnet 5.5 solo sirven en la cuenta que los creó o en cuentas vinculadas a ella. Si se envían desde otra cuenta, los bloques se descartan y la solicitud tiene éxito. El anuncio dice que esto «incluye cambiar de cuenta a mitad de sesión en Claude Code». |
| Ha bajado el mínimo de la caché | Los prompts de 512 a 1023 tokens pasan a almacenarse en caché. Empieza a cobrarse la escritura (1,25 veces la entrada con 5 minutos), pero a partir de la segunda vez se paga la tarifa de lectura (sección 3). |
Fuentes: What's new in Claude Sonnet 5.5, Migrating to Claude Sonnet 5.5 y el anuncio de Anthropic
El anuncio también describe cambios en las salvaguardas. Sonnet 5.5 es el primer Sonnet que sale con salvaguardas de ciberseguridad y un modelo de respaldo, porque su capacidad utilizable en ciberataques ha alcanzado el nivel de Opus 5: el trabajo de ciberseguridad de alto riesgo cambia de forma visible a Sonnet 5. Encontrar y corregir errores en el desarrollo cotidiano no se ve afectado. Las salvaguardas de biología son las mismas que en Sonnet 5.
En sentido contrario, también hay funciones nuevas. El effort por mensaje (beta; permite cambiar de nivel manteniendo la caché de prompts), los mensajes de sistema a mitad de conversación y el cambio de herramientas a mitad de conversación (beta) no existían en Sonnet 5. El What's new recoge además la compactación, que resume la conversación cuando tú quieras (beta, cabecera compact-2026-09-04), y la definición de herramientas dentro de los mensajes (beta, cabecera inline-tools-2026-09-15).
7. El effort por defecto: high en la API, medium en Claude Code
En Opus 5.5, el effort por defecto bajó a medium también en la API, pero en Sonnet 5.5 el valor por defecto de la API sigue siendo high. Por otro lado, el anuncio dice que «en Claude Code y en las apps, el valor por defecto es medium». Con el mismo Sonnet 5.5, la profundidad cuando no especificas nada difiere en un nivel entre la API y Claude Code.
La página oficial de effort recomienda estos puntos de partida para Sonnet 5.5.
| Tipo de trabajo | Nivel de partida (recomendación oficial) | Nota |
|---|---|---|
| Trabajo general (salvo los dos de abajo) | high | Igual que el valor por defecto de la API |
| Programación agéntica y uso de herramientas en varios pasos | Empezar por medium | medium para trabajos con especificaciones claras; high para los difíciles o largos |
| Trabajo sensible a la latencia, como el chat | medium o low | Prioriza la velocidad |
| xhigh y max | Solo si la evaluación muestra que mejora la calidad | No se pueden combinar con between_tools |
Fuentes: «Recommended effort levels for Claude Sonnet 5.5» en Anthropic, «Effort» y la guía de migración
La misma página recomienda también dar a max_tokens un tamaño que quepan tanto el thinking como la respuesta y, en programación agéntica, fijar max_tokens en 128.000, el máximo de este modelo, y recibir la respuesta en streaming. Aunque la configuración no devuelva el contenido del thinking, sus tokens cuentan para max_tokens. Cómo funciona el effort lo explicamos en detalle en nuestra guía del ajuste de effort, y el thinking adaptativo, en las diferencias entre thinking adaptativo y extendido.
8. Cómo elegir entre Sonnet 5.5, Opus 5.5 y Haiku
La lista oficial de modelos sigue diciendo «si dudas, empieza por Opus 5.5»: Sonnet 5.5 no se ha convertido en el punto de partida. Dicho esto, el anuncio distingue los puntos fuertes de Sonnet 5.5, «el trabajo diario bien delimitado, la corrección de errores y la creación de documentos, presentaciones y hojas de cálculo», de los de Opus 5.5, «el trabajo complejo que exige un criterio cuidadoso». Y añade: «Sonnet 5.5 complementa mejor a Opus 5.5 con un effort bajo. En los niveles altos, puede llegar a un rendimiento similar con un coste similar». Es decir, si vas a trabajar en xhigh o max, elegir Sonnet 5.5 apenas te da ventaja de coste.
- Quieres sacar rápido implementaciones o correcciones de errores con especificaciones claras, entre low y high.
- Creas muchos documentos, presentaciones y hojas de cálculo.
- Quieres desactivar el thinking previo para reducir la espera (
between_tools). - Usas Sonnet 5 (lo sustituyes al mismo precio).
- Necesitas mantener el criterio en diseños o investigaciones sin una respuesta definida.
- No te decides entre los dos (el punto de partida oficial).
- Vas a trabajar con un effort alto y la diferencia de coste con Sonnet 5.5 se reduce.
- Quieres usar el fast mode (solo en Opus).
- Tienes mucho volumen y lo prioritario es el coste por unidad (Haiku 4.5 cuesta la mitad que Sonnet 5.5).
- Te basta con un contexto de 200K tokens.
- El anuncio promete Haiku 5.5 para «las próximas semanas».
- La retirada de Haiku 4.5 será «no antes del 15 de octubre de 2026», así que revisa tus planes a futuro.
Si no lo tienes claro, este es el orden: ① prueba Sonnet 5.5 en medium y high con tu propio trabajo → ② si no basta, compáralo con Opus 5.5 en medium → ③ si el coste de Sonnet 5.5 en xhigh se iguala con el de Opus 5.5, elige Opus 5.5. Los detalles de Opus 5.5 están en nuestro análisis del lanzamiento de Opus 5.5, y la lista de todos los modelos del momento, en la lista de los principales modelos de IA y sus fechas de corte de conocimiento.
9. Usarlo en Claude Code y GitHub Copilot
Claude Code añadió Sonnet 5.5 en el CHANGELOG de v2.1.284 (28 de septiembre de 2026) y lo convirtió en el Sonnet por defecto en la API de Anthropic.
default sigue siendo Opus 5.5 en Pro, Max, Team, Enterprise y la API. Para usar Sonnet 5.5, elige /model sonnet (o claude --model sonnet al arrancar). Con versiones anteriores a v2.1.284 no está disponible, así que ejecuta claude update.
sonnet depende del proveedorSolo es Sonnet 5.5 en la API de Anthropic. En Claude Platform on AWS apunta a Sonnet 4.6, y en Bedrock, Agent Platform de Google Cloud y Microsoft Foundry, a Sonnet 4.5. Si lo usas ahí, elige el nombre completo del modelo o configura ANTHROPIC_DEFAULT_SONNET_MODEL.
Sonnet 5.5 empieza en medium. El antiguo effortLevel en el nivel superior de la configuración de usuario no afecta a Opus 5.5 ni a los modelos posteriores. El interruptor de thinking, alwaysThinkingEnabled y MAX_THINKING_TOKENS=0 tampoco tienen efecto en Sonnet 5.5.
Cuando reacciona un clasificador de las salvaguardas, la ciberseguridad se vuelve a ejecutar con Sonnet 5 y la sesión sigue con ese modelo (para volver, usa /model). En biología, Sonnet 5.5 no tiene modelo alternativo y termina en un rechazo.
Fuentes: Claude Code, «Model configuration» y el CHANGELOG (v2.1.284; comprobado el 29 de septiembre de 2026)
En cuanto al contexto, en la API de Anthropic Sonnet 5.5 siempre tiene 1M tokens, sin indicar [1m] ni pagar nada extra. El resumen automático (auto-compact) se ejecuta por defecto hacia los 967K tokens. A través de una pasarela LLM (con ANTHROPIC_BASE_URL configurado) se trata como 200K tokens, así que elige «Sonnet 5.5 (1M context)» (sonnet[1m]) en el selector de modelos.
opusplan, que reparte la planificación a Opus y la ejecución a Sonnet, funciona en la API de Anthropic con Opus 5.5 y Sonnet 5.5, respectivamente. Cómo usarlo lo explicamos en nuestra guía de opusplan. Como Claude Code avanza las conversaciones solo añadiendo, la comprobación del historial del punto ③ de la sección 5 no le causa problemas (según la guía de migración de Opus 5.5).
GitHub Copilot
GitHub anunció la disponibilidad general de Sonnet 5.5 en su changelog del mismo 28 de septiembre. Está disponible en Copilot Pro, Pro+, Max, Business y Enterprise, y se elige en el selector de modelos de VS Code, Visual Studio, Copilot CLI, Copilot coding agent, github.com, los IDE de JetBrains, Xcode y otros. El despliegue es gradual, así que puede que no aparezca de inmediato. Se factura según el uso, al precio de lista del proveedor. En Business y Enterprise, el administrador decide si se puede usar mediante la política de modelos de la configuración de Copilot.
10. Pasos de migración (para quien usa la API)
De la lista de comprobación de la guía de migración, hemos ordenado según el flujo de trabajo los puntos que se aplican a quien viene de Sonnet 5. Claude Code tiene además /claude-api migrate para ayudarte con esto (una skill incluida que menciona la guía de migración; antes de editar, te pide confirmar el alcance).
- Cambia el ID del modelo de
claude-sonnet-5aclaude-sonnet-5-5(en Bedrock,anthropic.claude-sonnet-5-5). - Sustituye
thinking: {"type": "disabled"}por{"type": "between_tools"}y pon el effort en high o menos. - Sustituye
anyytoolentool_choiceporauto+ strict tool use (en Bedrock, soloauto, y valida tú la entrada). - Si reescribes
system,toolso mensajes anteriores a mitad de camino, pásalo a un esquema de solo añadir. - Si usas computer use en la Claude API o Google Cloud, pásate a
computer_toolset_20260801y adapta el bucle. - Si el asesor de la herramienta advisor es Opus 4.8, Opus 4.7, Sonnet 5 u otros similares, cámbialo por uno que admita Sonnet 5.5 y cuenta con que el consejo llegará cifrado.
- Si muestras el progreso en pantalla, pon
displayen"updates"o"summarized"(no hace falta conbetween_tools). - Gestiona
stop_reason: "refusal"y configura el respaldo. - Si tienes un mecanismo que enruta a otros modelos, compruébalo dando por hecho que el razonamiento de Sonnet 5.5 no se transfiere.
- Vuelve a ajustar el effort y vuelve a medir el coste y la latencia. Comprueba también la caché de los prompts de menos de 1024 tokens.
Fuente: apartados «Every starting model» y «Migrating to Claude Sonnet 5.5 from Claude Sonnet 5» de Anthropic, «Migrating to Claude Sonnet 5.5», reordenados según el flujo de trabajo
Si vienes directamente desde Sonnet 4.6 o anteriores, además tendrás que tener en cuenta que el thinking se ejecutará también en los procesos en los que no lo especificabas, los 400 del presupuesto de thinking y de temperature y similares, y que el mismo texto genera alrededor de un 30 % más de tokens. Si lo usas en Claude Managed Agents, no hace falta cambiar nada salvo el nombre del modelo (nota de la guía de migración).
Conclusiones
Claude Sonnet 5.5 es un lanzamiento que mejora mucho el rendimiento sin tocar el precio y, a cambio, acerca las reglas de la API a las de Opus 5.5. En la propia tabla de Anthropic mejora respecto a Sonnet 5 en todas las filas, y en muchas se queda a pocos puntos de Opus 5.5. En cambio, disabled, el uso forzado de herramientas, la antigua herramienta de computer use, la reescritura del historial y algunas combinaciones del advisor pasan a provocar errores 400.
Lo más fácil de pasar por alto es que el sustituto para desactivar el thinking, between_tools, solo se acepta con high o menos, y la discrepancia de que el effort por defecto sea high en la API y medium en Claude Code. En la API, indica el effort de forma explícita; en Claude Code, selecciónalo con /model sonnet y comprueba el effort. Si sale más barato o no, mídelo con usage, no con las tarifas.
Por último, las cifras de los benchmarks son valores medidos en esa tabla y con esas condiciones. La propia Anthropic escribe que «en el trabajo complejo y abierto, Opus 5.5 sigue siendo claramente más fuerte». Empieza comparando Sonnet 5.5 en medium y en high con tu propio trabajo.
Preguntas frecuentes
P. ¿Sonnet 5.5 es más caro que Sonnet 5?
R. Las tarifas son iguales en todas las partidas ($2 de entrada, $10 de salida, $0,20 de lectura de caché y la mitad en la Batch API). Anthropic dice que es «hasta un 30 % más barato por tarea», pero es una medición propia. Como los niveles de effort se han recalibrado, compruébalo con usage después de migrar.
P. ¿Hay alguna forma de desactivar el thinking?
R. En la API, thinking: {"type": "between_tools"} detiene el thinking previo. En una solicitud que no usa herramientas, la respuesta queda solo con el texto. Pero con effort xhigh y max da 400, y las notas de progreso entre herramientas se devuelven en bloques de thinking. En Claude Code, los ajustes para desactivar el thinking no afectan a Sonnet 5.5.
P. Cambié el ID del modelo y me da un error 400.
R. Lo puedes distinguir por el mensaje de error. "thinking.type.disabled" apunta a la configuración del thinking; tool_choice: type "tool" and "any", al uso forzado de herramientas, y computer_20251124, a la antigua herramienta de computer use. Si te pasa usando between_tools, revisa si el effort es xhigh o superior o si envías display u otros campos a la vez. Si usas la herramienta advisor, sospecha del modelo asesor, y si reescribes el historial a mitad de conversación, de la comprobación de los bloques de thinking (punto ③ de la sección 5).
P. Claude Code no está usando Sonnet 5.5.
R. El modelo por defecto es Opus 5.5, así que selecciónalo con /model sonnet. Si aun así sigue en Sonnet 5, tu versión es anterior a v2.1.284: ejecuta claude update. En Bedrock, Google Cloud, Claude Platform on AWS y Microsoft Foundry, sonnet apunta a un Sonnet antiguo, así que elige el nombre completo del modelo o configura ANTHROPIC_DEFAULT_SONNET_MODEL.
P. ¿Qué debería poner por defecto, Opus 5.5 o Sonnet 5.5?
R. El punto de partida oficial es Opus 5.5. Si lo tuyo es sobre todo implementación bien delimitada, corrección de errores y creación de documentos, con un effort entre low y high, Sonnet 5.5 te cuesta la mitad por token de entrada y de salida. Si vas a trabajar en xhigh o max, la diferencia de coste se reduce, como dice el anuncio, así que compara los dos con tu propio trabajo.
Nota: las cifras de este artículo se basan en el anuncio oficial de Anthropic, «Introducing Claude Sonnet 5.5» (los benchmarks, en la tabla comparativa y los textos de los gráficos de esa página), en la documentación oficial «Models overview», «Claude Sonnet 5.5», «What's new in Claude Sonnet 5.5», «Migrating to Claude Sonnet 5.5», «Pricing», «Thinking», «Effort» y «Prompt caching», en «Model configuration» y el CHANGELOG de Claude Code, y en el changelog de GitHub (todo comprobado el 29 de septiembre de 2026). Las especificaciones y los precios pueden cambiar, así que haz la comprobación final en la documentación oficial.
Artículos relacionados: Análisis del lanzamiento de Claude Opus 5.5, Cambios incompatibles y migración a Claude Fable 5.1, Comparativa de precios de Claude.