Le 28 septembre 2026, Anthropic a publié Claude Sonnet 5.5. D'après l'annonce, c'est le deuxième modèle de la famille Claude 5.5, après Opus 5.5 six jours plus tôt, et le précédent Sonnet 5 (sorti le 30 juin 2026) est passé en Legacy (ancien, mais toujours disponible). La vue d'ensemble officielle des modèles le présente comme le modèle qui offre la meilleure combinaison de vitesse et d'intelligence.

En résumé : les prix sont exactement ceux de Sonnet 5 ($2 en entrée, $10 en sortie et $0.20 en lecture de cache par million de tokens), et dans le tableau comparatif d'Anthropic, il progresse nettement par rapport à Sonnet 5 sur la plupart des lignes. L'API se comporte toutefois différemment : cinq changements font échouer avec une erreur 400 du code qui fonctionnait sur Sonnet 5. Surtout, thinking: {"type": "disabled"} ne permet plus de désactiver le thinking, et son remplaçant, between_tools, n'est accepté qu'avec un effort high ou inférieur. Cet article confronte le texte original de la documentation officielle et de l'annonce, et présente, dans l'ordre où vous en aurez besoin, ce qui a changé, ce qui casse lors de la migration et comment choisir entre lui et Opus 5.5.

Informations au 29 septembre 2026 : rédigé le lendemain du lancement, après lecture du texte original de la documentation officielle de Claude Platform (Models overview, la page Sonnet 5.5, What's new, le guide de migration, Pricing, Thinking, Effort et Prompt caching), de l'annonce d'Anthropic, de la documentation et du CHANGELOG de Claude Code, et du changelog de GitHub. Claude Haiku 5.5, annoncé pour les semaines à venir, n'était pas encore sorti à cette date.

CLAUDE SONNET 5.5 — 2026.09.28

Même prix, cinq changements incompatibles

— Présenté officiellement comme la meilleure combinaison de vitesse et d'intelligence

ID du modèle
claude-sonnet-5-5
Sans suffixe de date (vue d'ensemble officielle des modèles)
Prix (par million de tokens)
$2 / $10
Identique à Sonnet 5 (page officielle des tarifs)
Effort par défaut
high sur l'API
medium dans Claude Code et les applications (documentation officielle et annonce)
Attention
5 changements incompatibles
Listés officiellement comme breaking changes
Source : annonce officielle d'Anthropic et documentation de Claude Platform (28 septembre 2026)

1. Sonnet 5.5 en bref : performances, prix, pièges de la migration

① Performances

Dans le tableau comparatif d'Anthropic, il bat Sonnet 5 sur toutes les lignes et arrive à 2 points d'Opus 5.5 sur GDPval-AA. L'annonce elle-même indique toutefois qu'Opus 5.5 reste nettement plus fort sur les travaux complexes et ouverts.

② Prix

Tous les tarifs sont identiques à ceux de Sonnet 5. Ce qui change, c'est la longueur minimale pouvant être mise en cache, qui passe de 1 024 à 512 tokens. L'annonce parle d'un coût par tâche jusqu'à 30 % inférieur, mais c'est une mesure d'Anthropic.

③ Pièges de la migration

Cinq changements : la désactivation du thinking passe à between_tools / l'utilisation forcée d'outils renvoie une erreur 400 / les blocs de thinking sont liés au modèle et à la conversation / l'ancien outil de computer use est refusé / certaines associations avec l'advisor sont refusées. En plus, le texte entre les appels d'outils revient dans des blocs de thinking.

En une phrase, Sonnet 5.5 est un Sonnet qui monte d'un cran au même prix, et qui se manipule selon des conventions presque identiques à celles d'Opus 5.5. Trois des cinq changements incompatibles (utilisation forcée d'outils, liaison des blocs de thinking et ancien outil de computer use) s'appliquent aussi à Opus 5.5 et à Fable 5.1. Ce qui est propre à Sonnet 5.5 se résume à deux points : un moyen de réduire le thinking subsiste sous la forme d'une valeur distincte, between_tools, et il existe des restrictions sur les associations avec l'outil advisor.

2. Caractéristiques principales et disponibilité

La comparaison porte sur trois modèles : Sonnet 5, qu'il remplace ; Opus 5.5, au-dessus ; et Haiku 4.5, en dessous.

Élément Sonnet 5.5 Sonnet 5 (Legacy) Opus 5.5 Haiku 4.5
ID du modèle dans l'API claude-sonnet-5-5 claude-sonnet-5 claude-opus-5-5 claude-haiku-4-5-20251001
Prix (entrée/sortie) $2 / $10 $2 / $10 $4 / $20 $1 / $5
Contexte / sortie maximale 1M / 128K 1M / 128K 1M / 128K 200K / 64K
Thinking Adaptive thinking par défaut (minimum : between_tools) Adaptive thinking par défaut (désactivable avec disabled) Adaptive thinking toujours actif (non désactivable) Extended thinking (avec budget)
Effort par défaut sur l'API high high medium Non pris en charge
Limite de connaissances fiable Juin 2026 Janvier 2026 Juin 2026 Février 2025
Longueur minimale mise en cache 512 tokens 1 024 tokens 512 tokens 4 096 tokens
Vitesse (indication relative officielle) Rapide — Modérée La plus rapide
Retrait Pas avant le 28 septembre 2027 Pas avant le 30 juin 2027 Pas avant le 22 septembre 2027 Pas avant le 15 octobre 2026

Sources : Anthropic, « Models overview », « Claude Sonnet 5.5 », « Claude Sonnet 5 » et « Prompt caching » (consultés le 29 septembre 2026). La vitesse est une indication relative au sein de la gamme actuelle et n'est pas indiquée pour Sonnet 5, passé en Legacy. Les dates de retrait sont des engagements pour les plateformes exploitées par Anthropic ; Amazon Bedrock et Google Cloud fixent les leurs.

Seules trois lignes diffèrent de Sonnet 5 : le thinking, la limite de connaissances et la longueur minimale mise en cache. Le contexte, la sortie maximale et l'effort par défaut de l'API sont identiques, et le tokenizer est aussi le même que celui de Sonnet 5 : un même texte donne le même nombre de tokens (What's new). Sur la Message Batches API, l'ajout de l'en-tête bêta output-300k-2026-03-24 porte la limite de sortie à 300K tokens (comme pour Sonnet 5). Notez aussi qu'envoyer des valeurs autres que celles par défaut pour temperature, top_p ou top_k renvoie une erreur 400. C'était déjà le cas sur Sonnet 5, cela ne vous concerne donc que si vous passez directement de Sonnet 4.6 ou d'une version antérieure.

Où il est disponible

API / cloud

API Claude (claude-sonnet-5-5), Amazon Bedrock (anthropic.claude-sonnet-5-5), Claude Platform on AWS, Google Cloud et Microsoft Foundry. Il est sorti sur toutes les plateformes le jour du lancement.

Applications / outils de développement

claude.ai et les applications Claude (Anthropic a publié le prompt système de Sonnet 5.5), Claude Code (v2.1.284 et ultérieures) et GitHub Copilot (Pro, Pro+, Max, Business et Enterprise).

Ce qu'il n'a pas

Le fast mode (la variante plus rapide) ne concerne qu'Opus 5.5, Opus 5 et Opus 4.8 sur la page des tarifs ; Sonnet 5.5 ne l'a pas. Sur Bedrock, les structured outputs (y compris le strict tool use) ne sont pas disponibles pour Sonnet 5.5 (guide de migration).

3. Prix : identiques à Sonnet 5, sauf le minimum de mise en cache

La page officielle What's new indique que son prix est le même que celui de Sonnet 5, et que la mise en cache des prompts et le traitement par lots sont eux aussi au même prix. Voici le détail des tarifs.

Par million de tokens Sonnet 5.5 Sonnet 5 Opus 5.5 Haiku 4.5
Entrée $2 $2 $4 $1
Sortie $10 $10 $20 $5
Écriture en cache (5 min) $2.50 $2.50 $5 $1.25
Écriture en cache (1 heure) $4 $4 $8 $2
Lecture en cache $0.20 $0.20 $0.20 $0.10
Batch API (entrée/sortie) $1 / $5 $1 / $5 $2 / $10 $0.50 / $2.50

Source : Anthropic, « Pricing » (consulté le 29 septembre 2026). La Batch API applique une remise de 50 % sur les tarifs standard, en entrée comme en sortie.

Deux choses qui peuvent changer à « prix identique »

Des tarifs identiques ne garantissent pas une facture identique. Deux facteurs peuvent la faire varier.

Le premier est la longueur minimale mise en cache. Sur Sonnet 5, les prompts de moins de 1 024 tokens n'étaient pas mis en cache, même avec cache_control. Sur Sonnet 5.5, ce seuil descend à 512 tokens. Par exemple, une tâche qui envoie à chaque appel un prompt système de 800 tokens avec les définitions d'outils n'était pas éligible à la mise en cache sur Sonnet 5, mais elle est mise en cache sur Sonnet 5.5. Vous pouvez savoir si quelque chose a été mis en cache grâce au champ usage de la réponse : si cache_creation_input_tokens et cache_read_input_tokens valent tous deux 0, rien n'a été mis en cache (page officielle Prompt caching). Rester sous le minimum ne déclenche pas d'erreur : pendant la migration, il vaut donc la peine de rechercher les tâches où la mise en cache ne fonctionnait pas, sans que rien ne le signale.

Le second est le nombre de tokens par tâche. L'annonce indique qu'il lui faut beaucoup moins de tokens pour le même travail, qu'il est jusqu'à 30 % moins cher par tâche dans les tests d'Anthropic, et qu'il génère sa sortie plus de 30 % plus vite que Sonnet 5. Ce sont des mesures d'Anthropic. Parallèlement, la documentation officielle précise que les niveaux d'effort ont été recalibrés : un même niveau ne réfléchira pas forcément autant que sur Sonnet 5. Les tokens de thinking sont facturés comme des tokens de sortie, même lorsqu'ils ne sont pas affichés. Après la migration, le seul moyen de savoir est de mesurer usage et de comparer sur votre propre charge de travail.

Exemple chiffré : une tâche avec 10 millions de tokens lus en cache, 500K en entrée et 300K en sortie (nombres de tokens supposés par cet article ; coûts d'écriture omis)

  • Sonnet 5.5 : $2.00 + $1.00 + $3.00 = $6.00 (identique sur Sonnet 5)
  • Opus 5.5 : $2.00 + $2.00 + $6.00 = $10.00 (environ 1,7 fois Sonnet 5.5, pas 2 fois)
  • Haiku 4.5 : $1.00 + $0.50 + $1.50 = $3.00 (exactement la moitié de Sonnet 5.5)

Cette comparaison porte sur les tarifs à nombre de tokens égal ; en pratique, chaque modèle utilise un nombre de tokens différent. Tarifs tirés de « Pricing » d'Anthropic.

L'écart avec Opus 5.5 n'est pas de « 2 fois » parce que la lecture en cache, à elle seule, coûte les mêmes $0.20 sur Opus 5.5. Plus la part du cache est élevée dans une charge de travail agentique, moins choisir Sonnet 5.5 fait économiser. Les tarifs de tous les modèles Claude sont présentés dans notre comparatif des prix d'Opus, Sonnet et Haiku.

4. Benchmarks : les lire à l'intérieur du tableau d'Anthropic

Le tableau comparatif de l'annonce comporte quatre colonnes : Sonnet 5.5, Sonnet 5, Opus 5.5 et GPT-6 Sol. Voici d'abord les conditions du tableau.

  • Le tableau provient de l'annonce d'Anthropic, et la plupart des lignes sont des mesures d'Anthropic. Les exceptions sont GDPval-AA v2.1 et AA-Briefcase v1.1, exécutés par Artificial Analysis (note 3).
  • Artificial Analysis a mené ces tests dans un environnement de pré-lancement qui comportait un bug pouvant dégrader les réponses aux requêtes utilisant les structured outputs. Anthropic précise que l'effet éventuel serait faible et ferait paraître les scores plus bas, et indique que le bug a été corrigé.
  • Le chiffre Terminal-Bench 4.0 d'Opus 5.5 est en xhigh et correspond au meilleur score d'Opus 5.5 (note 1). Sonnet 5.5 a deux chiffres sur FrontierCode : 46,2 % en max et 52,1 % en xhigh (note 2).
  • Les scores GDPval-AA, AA-Briefcase et Chartography de GPT-6 Sol sont assortis d'une note indiquant qu'ils pourraient être antérieurs à la correction par OpenAI d'un bug de compréhension d'images (note 4).
Benchmark Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0
Codage agentique dans le terminal
70,6 % 10,3 % 66,4 % (xhigh) —
FrontierCode 1.1 (Main)
Si les modifications sont fusionnées
52,1 % (xhigh)
46,2 % (max)
42,4 % 54,4 % 49,3 %
CursorBench 4.0
Tâches ambiguës sur plusieurs fichiers
55,5 % 34,1 % 57,8 % —
GDPval-AA v2.1 (Elo)
Travail réel dans 44 métiers (exécuté par Artificial Analysis)
1844 1449 1846 1487
AA-Briefcase v1.1 (Elo)
Travail intellectuel de longue haleine (exécuté par Artificial Analysis)
1811 1359 1822 1483
Humanity's Last Exam
Raisonnement interdisciplinaire (avec outils)
64,5 % 54,9 % 67,7 % —
OSWorld 2.1
Computer use (le tableau indique « partial »)
80,1 % 57,0 % 81,8 % —
Chartography
Lecture de graphiques (sans outils)
61,6 % 15,6 % 64,4 % 53,6 %

Source : tableau comparatif et notes de « Introducing Claude Sonnet 5.5 » d'Anthropic (28 septembre 2026 ; consulté le 29 septembre). Le gras signale la valeur la plus élevée de chaque ligne ; « — » signifie que le tableau ne donne pas de valeur. Le détail de la méthodologie figure dans la system card de Sonnet 5.5, en lien depuis la même annonce.

Trois points ressortent.

  • Le saut par rapport à Sonnet 5 est important. Terminal-Bench 4.0 passe de 10,3 % à 70,6 %, et Chartography (sans outils) de 15,6 % à 61,6 % : plusieurs fois plus au sein du même tableau. GDPval-AA progresse d'environ 400 points.
  • L'écart avec Opus 5.5 ne dépasse pas quelques points sur la plupart des lignes. 2 points d'écart sur GDPval-AA, 2,3 points sur CursorBench et 1,7 point sur OSWorld 2.1. Sur Terminal-Bench 4.0, Sonnet 5.5 dépasse même le meilleur score d'Opus 5.5 (66,4 % en xhigh).
  • Anthropic place toujours Opus 5.5 au-dessus. L'annonce indique que les benchmarks ne saisissent qu'une facette des capacités, et qu'en interne comme chez les testeurs externes, Opus 5.5 reste nettement plus fort sur les travaux complexes et ouverts qui exigent un jugement soutenu.

Coût selon le niveau d'effort : d'après les descriptions des graphiques de l'annonce

L'annonce comporte aussi des graphiques qui mettent en regard le score et le coût par tâche pour chaque niveau d'effort. Voici ce qu'en disent leurs descriptions.

Terminal-Bench 4.0

En medium, le niveau par défaut des applications Claude, il dépasse nettement le meilleur score de Sonnet 5 pour moins d'un dixième du coût par tâche.

FrontierCode 1.1

En high, le niveau par défaut de Claude Platform, il égale le meilleur score de GPT-6 Sol pour environ un cinquième du coût par tâche. Il a 10 points de plus que Sonnet 5 au même niveau high, pour environ un quinzième du coût.

CursorBench 4.0

En low, le niveau le plus bas, il dépasse le meilleur score de Sonnet 5 pour moins d'un dixième du coût par tâche.

AA-Briefcase v1.1

En medium, il dépasse le meilleur score de Sonnet 5 pour environ un neuvième du coût par tâche.

Source : descriptions des graphiques de « Introducing Claude Sonnet 5.5 » d'Anthropic. Les graphiques Terminal-Bench et CursorBench montrent GPT-5.6 Sol, car les scores de GPT-6 Sol n'ont pas été publiés (note sur la même page).

Les deux chiffres FrontierCode méritent qu'on s'y arrête. Sonnet 5.5 obtient un score plus bas en max (46,2 %) qu'en xhigh (52,1 %). D'après la note de l'annonce d'Anthropic, en max il lançait plus souvent le skill de revue de code de Claude Code et répartissait le travail entre de nombreux sous-agents, ce qui a parfois entraîné des dépassements de délai et des modifications hors du périmètre de la tâche. Augmenter l'effort n'augmente pas toujours le score : choisissez le niveau en comparant sur votre propre travail (section 7). Les chiffres de GPT-6 Sol sont présentés dans notre présentation de GPT-6 Sol et Luna.

Ne mélangez pas avec le tableau de l'annonce d'Opus 5.5 : pour le même Opus 5.5, Chartography est donné à 89,0 % « avec outils » dans l'annonce d'Opus 5.5 et à 64,4 % « sans outils » dans ce tableau, dans des conditions différentes. Si vous prenez des chiffres dans les deux annonces pour les mettre côte à côte, vous comparez des valeurs mesurées dans des conditions différentes. Limitez les comparaisons aux colonnes d'un même tableau.

5. Cinq changements incompatibles qui provoquent une erreur 400 en venant de Sonnet 5, et les correctifs

La page officielle What's new in Claude Sonnet 5.5 liste cinq changements incompatibles (breaking changes) qui affectent du code fonctionnant sur Sonnet 5. Chacun échoue avec une erreur 400 invalid_request_error.

① Pour désactiver le thinking, utilisez between_tools au lieu de disabled

Sur Sonnet 5, thinking: {"type": "disabled"} désactivait le thinking quel que soit le niveau d'effort. Sur Sonnet 5.5, disabled renvoie une erreur 400 avec ce message :

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

Le remplaçant est thinking: {"type": "between_tools"}, le réglage de thinking le plus bas de ce modèle, qui supprime la « réflexion préalable » que fait le modèle avant de répondre. Pour les requêtes sans outils, la réponse ne contient que du texte, comme avec disabled sur Sonnet 5. Aucun en-tête bêta n'est nécessaire, et il fonctionne sur toutes les plateformes qui proposent Sonnet 5.5. Mais si vous le substituez tel quel à disabled, trois points vous feront trébucher.

  • Il renvoie une erreur 400 avec un effort xhigh ou max. between_tools n'est accepté qu'en low, medium et high. Pour les tâches qui tournaient « en xhigh avec le thinking désactivé » sur Sonnet 5, il faut soit abaisser l'effort à high ou moins, soit renoncer à désactiver le thinking.
  • Vous ne pouvez pas envoyer d'autres champs avec lui. Envoyer display, budget_tokens ou block_binding avec between_tools renvoie une erreur 400.
  • Vous ne pouvez pas changer d'effort en cours de conversation. Envoyer un autre niveau avec l'effort par message (bêta) renvoie une erreur 400. Si vous voulez faire varier le niveau à chaque tour, utilisez l'adaptive thinking (omettez thinking ou envoyez {"type": "adaptive"}).

Voici l'exemple avant/après du guide de migration en Python. Notez que comme l'exemple « avant » utilise xhigh, l'exemple « après » l'abaisse à high.

# Avant : fonctionne sur Sonnet 5, renvoie une 400 sur Sonnet 5.5
client.messages.create(
    model="claude-sonnet-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    output_config={"effort": "xhigh"},
    messages=[{"role": "user", "content": "..."}],
)

# Après : supprime la réflexion préalable ; l'effort doit être high ou moins
client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=16000,
    thinking={"type": "between_tools"},
    output_config={"effort": "high"},
    messages=[{"role": "user", "content": "..."}],
)

Même avec between_tools, les courtes notes de progression que le modèle écrit entre les appels d'outils reviennent sous forme de blocs de thinking contenant un texte de résumé. Ne les jetez pas ; renvoyez-les sans modification avec le reste du tour de l'assistant. À partir des blocs renvoyés, le modèle reçoit le texte intégral des notes qu'il a écrites (What's new). Un budget manuel, {"type": "enabled", "budget_tokens": N}, renvoie toujours une erreur 400, comme sur Sonnet 5.

② L'utilisation forcée d'outils renvoie une erreur

Régler tool_choice sur {"type": "any"} ou {"type": "tool", "name": "..."} renvoie une erreur 400. L'API de comptage des tokens applique la même vérification. Seuls auto (par défaut) et none sont autorisés.

tool_choice: type "tool" and "any" are not supported for this model.

Correctif : gardez tool_choice sur auto et ajoutez strict: true aux définitions d'outils (strict tool use), ou déplacez le schéma vers les structured outputs. Avec auto, le modèle peut répondre en texte sans appeler l'outil : précisez donc dans le prompt quand il doit utiliser cet outil. Le strict tool use n'accepte qu'un sous-ensemble de JSON Schema, et chaque objet du schéma doit comporter additionalProperties: false. Vous pouvez rendre stricts jusqu'à 20 outils par requête, et strict ne peut pas être défini sur les toolsets MCP, computer use ou browser use.

# Avant : fonctionne sur Sonnet 5, renvoie une 400 sur Sonnet 5.5
client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    tools=tools,
    tool_choice={"type": "tool", "name": "get_weather"},
    messages=[{"role": "user", "content": "What's the weather in Paris?"}],
)

# Après : auto + strict ; indiquez dans le prompt quand utiliser l'outil
client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=1024,
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[{"role": "user",
               "content": "What's the weather in Paris? Use the get_weather tool."}],
)

Amazon Bedrock fait exception. Les structured outputs (y compris le strict tool use) ne sont pas disponibles pour Sonnet 5.5 sur Bedrock : envoyez auto sans strict, précisez dans le prompt quand appeler l'outil, et validez les entrées des outils dans votre propre code (guide de migration).

③ Les blocs de thinking sont liés au modèle et à la conversation

Chaque bloc de thinking enregistre le modèle qui l'a produit. Sonnet 5.5 peut lire les blocs de thinking de Sonnet 5, Opus 4.8, Haiku 4.5 et des modèles antérieurs, mais pas ceux d'Opus 5, Opus 5.5, Fable ou Mythos. Et aucun autre modèle ne peut lire les blocs de thinking de Sonnet 5.5.

  • Passer de Sonnet 5 à Sonnet 5.5 conserve le raisonnement antérieur.
  • Passer de Sonnet 5.5 à n'importe quel autre modèle signifie que les tours qui suivent le changement se déroulent sans le raisonnement de Sonnet 5.5. La requête elle-même réussit, et les blocs abandonnés ne sont pas facturés.

Fable 5.1 et Mythos 5.1 peuvent lire les blocs de thinking d'Opus 5.5, mais personne ne peut lire ceux de Sonnet 5.5. Si vous faites monter « seulement les parties difficiles de Sonnet 5.5 vers Opus 5.5 », testez en partant du principe que le raisonnement de Sonnet 5.5 disparaît au niveau du modèle vers lequel vous escaladez.

Il y a une vérification de plus : tout ce qui précède un bloc de thinking de Sonnet 5.5 (system, tools et les messages antérieurs) a-t-il changé depuis la production du bloc ? Pour les comptes créés le 31 août 2026 à 00:00 UTC ou après, cette vérification est appliquée par défaut sur l'API Claude, Amazon Bedrock et Google Cloud, et envoyer un bloc avec un historique réécrit en cours de route renvoie une erreur 400.

Correctif : faites avancer la conversation uniquement par ajout. Quand vous voulez changer d'instructions ou d'outils, utilisez un message système en cours de conversation au lieu de réécrire l'historique (une fonction nouvellement disponible sur Sonnet 5.5, que Sonnet 5 n'a pas). Si la réécriture est inévitable, ajoutez l'en-tête bêta thinking-binding-controls-2026-08-01 et réglez thinking.block_binding.prefix_mismatch_behavior sur "drop_block" pour que les blocs concernés soient abandonnés au lieu de déclencher une erreur. Mais block_binding ne fonctionne qu'avec l'adaptive thinking : avec between_tools, procédez uniquement par ajout, ou retirez vous-même les blocs de thinking à partir du tour réécrit.

④ L'ancien outil de computer use est refusé sur l'API Claude et Google Cloud

Sonnet 5 acceptait aussi le computer use via l'ancien outil computer_20251124 avec un en-tête bêta. Sur l'API Claude et Google Cloud, Sonnet 5.5 n'accepte que le toolset computer_toolset_20260801, et déclarer l'ancien outil renvoie une erreur 400. Sur l'API Claude, le message commence ainsi :

'claude-sonnet-5-5' does not support tool types: computer_20251124.

Correctif : supprimez l'en-tête bêta, remplacez tools par [{"type": "computer_toolset_20260801"}], et adaptez votre boucle d'agent à la forme du toolset (blocs tool_use pour les membres, plusieurs actions à la fois, et toolset_name dans les résultats). Si vous envoyez l'en-tête bêta fine-grained-tool-streaming-2025-05-14, supprimez-le. L'envoyer avec le toolset renvoie une erreur 400 : ajoutez donc eager_input_streaming: true à chaque outil qui en a besoin. Sur Amazon Bedrock, l'ancien outil fonctionne toujours, aucun changement n'est donc nécessaire.

⑤ Certaines associations avec l'outil advisor sont refusées

L'outil advisor (bêta) permet à un modèle exécutant de demander conseil à un modèle plus puissant. Quand Sonnet 5.5 est l'exécutant, désigner Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5 ou Sonnet 4.6 comme advisor renvoie une erreur 400. Les advisors autorisés sont Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 et Mythos 5.1.

De plus, tous les advisors acceptés par Sonnet 5.5 renvoient leurs conseils dans un bloc chiffré advisor_redacted_result : le client ne peut donc pas lire le texte des conseils. Tout ce qui enregistrait les conseils dans des journaux ou les affichait à l'écran doit être reconstruit. Les associations économiques comme « Sonnet 5 en exécutant, Opus 4.8 en advisor » ne peuvent pas être reprises telles quelles avec Sonnet 5.5.

6. Les changements qui surviennent sans erreur

Les cinq changements incompatibles déclenchent une erreur 400 : vous les remarquerez. Les plus délicats sont les changements de comportement qui ne déclenchent aucune erreur.

Changement Ce qui se passe / que faire
Le texte entre les appels d'outils passe dans des blocs de thinking Les notes de plus d'une ou deux phrases, comme « Je vais maintenant vérifier X », qui étaient des blocs de texte sur Sonnet 5, reviennent désormais dans des blocs de thinking de progression (une courte ligne reste en texte). Avec le réglage par défaut display: "omitted", leur contenu est vide : une interface qui diffusait la progression aux utilisateurs devient muette pendant les appels d'outils. Avec l'adaptive thinking, réglez display sur "updates" (bêta, en-tête thinking-display-updates-2026-08-18) ou "summarized", et affichez les blocs de thinking non vides avant le tool_use qui suit. Avec between_tools, le texte revient sans aucun réglage.
Les niveaux d'effort ont été recalibrés Un même niveau ne réfléchira pas forcément autant que sur Sonnet 5. La consigne officielle est de ne pas reprendre les réglages tels quels mais de réajuster l'effort (section 7).
Les refus ont désormais cinq catégories cyber, bio, frontier_llm, reasoning_extraction et general_harms. Un refus renvoie HTTP 200 avec stop_reason: "refusal" : lisez donc stop_details et traitez-le. Le repli côté serveur (fallbacks: "default", bêta, API Claude uniquement) ne réessaie sur Sonnet 5 que cyber et frontier_llm.
Les blocs de thinking sont liés au compte qui les a créés Les blocs de thinking de Sonnet 5.5 ne peuvent être utilisés que par le compte qui les a créés ou par les comptes qui lui sont liés. S'ils sont envoyés depuis un autre compte, les blocs sont abandonnés et la requête réussit. L'annonce précise que cela inclut le changement de compte en cours de session dans Claude Code.
Le minimum de mise en cache a baissé Les prompts de 512 à 1 023 tokens sont désormais mis en cache. Cela ajoute un coût d'écriture (1,25 fois le prix de l'entrée pour 5 minutes), tandis qu'à partir du deuxième appel vous ne payez que le tarif de lecture (section 3).

Sources : What's new in Claude Sonnet 5.5, Migrating to Claude Sonnet 5.5, annonce d'Anthropic

L'annonce décrit aussi des changements dans les garde-fous. Sonnet 5.5 est le premier Sonnet livré avec des garde-fous cyber et un repli, car ses capacités exploitables pour des cyberattaques ont atteint le niveau d'Opus 5 ; le travail de cybersécurité à haut risque bascule de façon visible vers Sonnet 5. La recherche et la correction de bugs dans le développement courant ne sont pas concernées. Les garde-fous en biologie sont les mêmes que sur Sonnet 5.

À l'inverse, certaines fonctions ont été ajoutées. L'effort par message (bêta ; permet de changer de niveau tout en conservant le cache du prompt), les messages système en cours de conversation et le changement d'outils en cours de conversation (bêta) n'étaient pas disponibles sur Sonnet 5. What's new mentionne aussi la compaction, qui résume la conversation quand vous le demandez (bêta, en-tête compact-2026-09-04), et la définition d'outils à l'intérieur des messages (bêta, en-tête inline-tools-2026-09-15).

7. Effort par défaut : high sur l'API, medium dans Claude Code

Opus 5.5 a abaissé son effort par défaut à medium, même sur l'API, mais Sonnet 5.5 conserve high comme valeur par défaut de l'API. En revanche, l'annonce indique que la valeur par défaut dans Claude Code et les applications est désormais medium. Le même Sonnet 5.5 réfléchit par défaut d'un niveau différent sur l'API et dans Claude Code.

La page officielle sur l'effort recommande ces points de départ pour Sonnet 5.5 :

Type de travail Niveau de départ (recommandation officielle) Remarques
Travail général (hors des deux cas ci-dessous) high Identique à la valeur par défaut de l'API
Codage agentique et utilisation d'outils en plusieurs étapes Commencer en medium medium pour un travail bien spécifié ; high pour un travail difficile ou long
Travail sensible à la latence, comme le chat medium ou low Priorité à la vitesse
xhigh et max Uniquement si les évaluations montrent une meilleure qualité Non combinable avec between_tools

Sources : « Recommended effort levels for Claude Sonnet 5.5 » dans Anthropic, « Effort », et le guide de migration

La même page recommande aussi de régler max_tokens assez haut pour couvrir à la fois le thinking et la réponse, et, pour le codage agentique, de régler max_tokens sur la limite de ce modèle, 128 000, et de recevoir la réponse en streaming. Les tokens de thinking comptent dans max_tokens, même dans les réglages où le contenu du thinking n'est pas renvoyé. Le fonctionnement de l'effort lui-même est expliqué dans notre guide du réglage de l'effort, et l'adaptive thinking dans adaptive thinking ou extended thinking.

8. Choisir entre Sonnet 5.5, Opus 5.5 et Haiku

La vue d'ensemble officielle des modèles indique toujours de commencer par Opus 5.5 en cas de doute ; Sonnet 5.5 n'est pas devenu le point de départ. Cela dit, l'annonce décrit les points forts de Sonnet 5.5 comme le travail quotidien bien délimité, la correction de bugs, et la création de documents, de présentations et de feuilles de calcul, et ceux d'Opus 5.5 comme le travail complexe qui exige un jugement attentif. Elle indique aussi que Sonnet 5.5 complète le mieux Opus 5.5 à faible effort, et qu'aux niveaux plus élevés les deux peuvent atteindre des performances similaires pour un coût similaire. Autrement dit, si vous travaillez en xhigh ou max, choisir Sonnet 5.5 vous apporte peu d'avantage de coût.

Choisir Sonnet 5.5
  • Vous voulez avancer vite sur de l'implémentation bien spécifiée et des corrections de bugs, de low à high.
  • Vous créez beaucoup de documents, de présentations et de feuilles de calcul.
  • Vous voulez supprimer la réflexion préalable pour réduire l'attente (between_tools).
  • Vous utilisez Sonnet 5 aujourd'hui (c'est un remplaçant au même prix).
Choisir Opus 5.5
  • Une conception ou une recherche ouverte exige un jugement soutenu.
  • Vous n'arrivez pas à choisir (le point de départ officiel).
  • Vous prévoyez de travailler à effort élevé, où l'écart de coût avec Sonnet 5.5 se réduit.
  • Vous voulez le fast mode (Opus uniquement).
Choisir Haiku
  • Vous traitez de gros volumes et le coût unitaire passe avant tout (Haiku 4.5 coûte moitié moins que Sonnet 5.5).
  • Un contexte de 200K tokens suffit.
  • L'annonce indique que Haiku 5.5 arrivera dans les semaines à venir.
  • Le retrait de Haiku 4.5 n'aura pas lieu avant le 15 octobre 2026 : vérifiez vos plans à l'avance.

En cas de doute, procédez dans cet ordre : ① faites tourner Sonnet 5.5 en medium et en high sur votre propre travail → ② si ce n'est pas suffisant, comparez avec Opus 5.5 en medium → ③ si Sonnet 5.5 en xhigh coûte à peu près autant qu'Opus 5.5, choisissez Opus 5.5. Opus 5.5 est présenté en détail dans notre présentation d'Opus 5.5, et la liste complète des modèles actuels dans les principaux modèles d'IA et leurs limites de connaissances.

9. L'utiliser dans Claude Code et GitHub Copilot

Claude Code a ajouté Sonnet 5.5 dans le CHANGELOG de la v2.1.284 (28 septembre 2026) et en a fait le Sonnet par défaut sur l'API Anthropic.

Le modèle par défaut reste Opus 5.5

default reste Opus 5.5 sur Pro, Max, Team, Enterprise et l'API. Pour utiliser Sonnet 5.5, sélectionnez /model sonnet (ou claude --model sonnet au lancement). Les versions antérieures à la v2.1.284 ne peuvent pas l'utiliser : lancez claude update.

Ce que désigne sonnet dépend du fournisseur

Il correspond à Sonnet 5.5 uniquement sur l'API Anthropic. Sur Claude Platform on AWS, il désigne Sonnet 4.6, et sur Bedrock, l'Agent Platform de Google Cloud et Microsoft Foundry, Sonnet 4.5. Sur ces plateformes, sélectionnez le nom complet du modèle ou définissez ANTHROPIC_DEFAULT_SONNET_MODEL.

L'effort démarre en medium ; le thinking n'est pas désactivable

Sonnet 5.5 démarre en medium. L'ancien réglage effortLevel au premier niveau des paramètres utilisateur n'a aucun effet sur Opus 5.5 et les modèles ultérieurs. Le bouton du thinking, alwaysThinkingEnabled et MAX_THINKING_TOKENS=0 n'ont pas non plus d'effet sur Sonnet 5.5.

La cyber bascule vers Sonnet 5 ; la biologie est refusée

Quand un classifieur de garde-fou se déclenche, le travail de cybersécurité est relancé sur Sonnet 5 et la session continue sur ce modèle (utilisez /model pour revenir). Pour la biologie, Sonnet 5.5 n'a pas de modèle de repli : la demande aboutit donc à un refus.

Sources : Claude Code, « Model configuration » et le CHANGELOG (v2.1.284 ; consultés le 29 septembre 2026)

Sur l'API Anthropic, Sonnet 5.5 dispose toujours d'un contexte de 1M tokens, sans suffixe [1m] ni supplément. L'auto-compact se déclenche par défaut vers 967K tokens. Via une passerelle LLM (avec ANTHROPIC_BASE_URL défini), le contexte est traité comme 200K tokens : sélectionnez alors « Sonnet 5.5 (1M context) » (sonnet[1m]) dans le sélecteur de modèles.

opusplan, qui confie la planification à Opus et l'exécution à Sonnet, tourne respectivement sur Opus 5.5 et Sonnet 5.5 sur l'API Anthropic. Son utilisation est expliquée dans notre guide d'opusplan. Claude Code fait lui-même avancer les conversations uniquement par ajout : il ne se heurte donc pas à la vérification de l'historique de la section 5 ③ (d'après le guide de migration d'Opus 5.5).

GitHub Copilot

Le même jour, le 28 septembre, GitHub a annoncé dans son changelog la disponibilité générale de Sonnet 5.5. Il est disponible sur Copilot Pro, Pro+, Max, Business et Enterprise, et peut être sélectionné dans le sélecteur de modèles de VS Code, Visual Studio, Copilot CLI, Copilot coding agent, github.com, des IDE JetBrains, de Xcode, etc. Le déploiement est progressif, il peut donc ne pas apparaître tout de suite. La facturation se fait à l'usage, au prix catalogue du fournisseur. Sur Business et Enterprise, les administrateurs décident de sa disponibilité via la politique de modèles des paramètres de Copilot.

10. Étapes de migration (utilisateurs de l'API)

Voici, tirés de la checklist du guide de migration, les points qui s'appliquent au passage depuis Sonnet 5, dans l'ordre de travail. Claude Code propose aussi /claude-api migrate pour vous y aider (un skill intégré mentionné par le guide de migration ; il confirme le périmètre avec vous avant de modifier quoi que ce soit).

  1. Changez l'ID du modèle de claude-sonnet-5 en claude-sonnet-5-5 (anthropic.claude-sonnet-5-5 sur Bedrock).
  2. Remplacez thinking: {"type": "disabled"} par {"type": "between_tools"} et réglez l'effort sur high ou moins.
  3. Remplacez any et tool dans tool_choice par auto avec le strict tool use (sur Bedrock, utilisez auto seul et validez vous-même les entrées).
  4. Si vous réécrivez system, tools ou des messages passés en cours de conversation, passez à un fonctionnement uniquement par ajout.
  5. Si vous utilisez le computer use sur l'API Claude ou Google Cloud, passez à computer_toolset_20260801 et adaptez la boucle.
  6. Si votre outil advisor utilise Opus 4.8, Opus 4.7, Sonnet 5 ou un modèle similaire comme advisor, passez à un modèle accepté par Sonnet 5.5, et partez du principe que les conseils reviennent chiffrés.
  7. Si vous affichez la progression à l'écran, réglez display sur "updates" ou "summarized" (inutile avec between_tools).
  8. Traitez stop_reason: "refusal" et mettez en place un repli.
  9. Si vous routez vers d'autres modèles, testez en partant du principe que le raisonnement de Sonnet 5.5 n'est pas transmis.
  10. Réajustez l'effort et mesurez de nouveau le coût et la latence. Vérifiez aussi la mise en cache des prompts de moins de 1 024 tokens.

Source : « Every starting model » et « Migrating to Claude Sonnet 5.5 from Claude Sonnet 5 » dans Anthropic, « Migrating to Claude Sonnet 5.5 », réordonnés dans l'ordre de travail

Si vous venez directement de Sonnet 4.6 ou d'une version antérieure, vous devez aussi gérer le thinking qui s'exécute même pour les tâches qui ne le spécifiaient pas, les erreurs 400 pour les budgets et pour temperature et les paramètres similaires, ainsi qu'environ 30 % de tokens en plus pour un même texte. Si vous l'utilisez via Claude Managed Agents, rien d'autre que le nom du modèle n'est à changer (note du guide de migration).

En résumé

Claude Sonnet 5.5 est une version qui relève nettement les performances sans toucher au prix, et qui, en contrepartie, aligne ses conventions d'API sur celles d'Opus 5.5. Dans le tableau même d'Anthropic, il progresse par rapport à Sonnet 5 sur toutes les lignes et arrive à quelques points d'Opus 5.5 sur la plupart. En revanche, disabled, l'utilisation forcée d'outils, l'ancien outil de computer use, l'historique réécrit et certaines associations avec l'advisor provoquent désormais des erreurs 400.

Les points les plus faciles à manquer sont que between_tools, le remplaçant de la désactivation du thinking, n'est accepté qu'en high ou moins, et le décalage selon lequel l'effort par défaut est high sur l'API mais medium dans Claude Code. Sur l'API, fixez l'effort explicitement ; dans Claude Code, sélectionnez-le avec /model sonnet puis vérifiez le niveau d'effort. Pour savoir s'il revient réellement moins cher, mesurez avec usage, pas avec les prix unitaires.

Enfin, les chiffres des benchmarks sont des valeurs mesurées dans ce tableau, dans ces conditions. Anthropic écrit lui-même qu'Opus 5.5 reste nettement plus fort sur les travaux complexes et ouverts. Commencez par comparer Sonnet 5.5 en medium et en high sur votre propre travail.

FAQ

Q. Sonnet 5.5 est-il plus cher que Sonnet 5 ?

R. Les tarifs sont identiques sur tous les postes ($2 en entrée, $10 en sortie, $0.20 en lecture de cache, et moitié prix sur la Batch API). Anthropic annonce un coût par tâche jusqu'à 30 % inférieur, mais c'est sa propre mesure. Comme les niveaux d'effort ont été recalibrés, vérifiez avec usage après la migration.

Q. Existe-t-il un moyen de désactiver le thinking ?

R. Sur l'API, thinking: {"type": "between_tools"} supprime la réflexion préalable. Pour les requêtes sans outils, la réponse ne contient que du texte. En revanche, il renvoie une erreur 400 avec un effort xhigh ou max, et les notes de progression entre les appels d'outils reviennent dans des blocs de thinking. Dans Claude Code, les réglages qui désactivent le thinking n'ont aucun effet sur Sonnet 5.5.

Q. J'ai changé l'ID du modèle et j'obtiens une erreur 400.

R. Le message d'erreur permet de savoir de quel changement il s'agit. "thinking.type.disabled" désigne le réglage du thinking, tool_choice: type "tool" and "any" l'utilisation forcée d'outils, et computer_20251124 l'ancien outil de computer use. Si l'erreur survient en utilisant between_tools, vérifiez si l'effort est xhigh ou plus, ou si vous envoyez display ou des champs similaires avec lui. Si vous utilisez l'outil advisor, soupçonnez le modèle advisor ; si vous réécrivez l'historique en cours de conversation, soupçonnez la vérification des blocs de thinking (section 5 ③).

Q. Claude Code n'utilise pas Sonnet 5.5.

R. Le modèle par défaut est Opus 5.5 : sélectionnez-le avec /model sonnet. Si c'est toujours Sonnet 5, votre version est antérieure à la v2.1.284 : lancez claude update. Sur Bedrock, Google Cloud, Claude Platform on AWS et Microsoft Foundry, sonnet désigne un Sonnet plus ancien : sélectionnez le nom complet du modèle ou définissez ANTHROPIC_DEFAULT_SONNET_MODEL.

Q. Dois-je mettre Opus 5.5 ou Sonnet 5.5 par défaut ?

R. Le point de départ officiel est Opus 5.5. Si votre travail consiste surtout en implémentation bien délimitée, corrections de bugs et création de documents, effectués de low à high, Sonnet 5.5 coûte moitié moins par token d'entrée et de sortie. Si vous travaillez en xhigh ou max, l'écart de coût se réduit, comme l'indique l'annonce : comparez donc les deux sur votre propre travail.

* Les chiffres de cet article s'appuient sur l'annonce officielle d'Anthropic, « Introducing Claude Sonnet 5.5 » (benchmarks tirés du tableau comparatif et des descriptions de graphiques de cette page), la documentation officielle « Models overview », « Claude Sonnet 5.5 », « What's new in Claude Sonnet 5.5 », « Migrating to Claude Sonnet 5.5 », « Pricing », « Thinking », « Effort » et « Prompt caching », les pages « Model configuration » et CHANGELOG de Claude Code, et le changelog de GitHub (tous consultés le 29 septembre 2026). Les caractéristiques et les prix peuvent évoluer : vérifiez les détails définitifs dans la documentation officielle.

Articles liés : présentation de Claude Opus 5.5, changements incompatibles et migration de Claude Fable 5.1, comparatif des prix de Claude.