Le 22 septembre 2026, Anthropic a publié Claude Opus 5.5. L'annonce le présente comme le premier modèle de la famille Claude 5.5, et il arrive deux mois à peine après Opus 5 (sorti le 24 juillet). Dans la vue d'ensemble des modèles de la documentation officielle, il devient le point de départ recommandé pour la plupart des usages quand on ne sait pas quel modèle choisir, et Opus 5 passe en Legacy (ancienne génération, mais toujours disponible).

En bref : le prix baisse par rapport à Opus 5 ($4 en entrée / $20 en sortie, contre $5 / $25 pour Opus 5). Mais le comportement de l'API change beaucoup, et quatre changements transforment du code qui fonctionnait sur Opus 5 en erreurs 400. S'y ajoute un autre point : l'effort appliqué quand on n'en précise aucun passe de high à medium. Si vous basculez sur la seule foi du prix, vous risquez soit des erreurs, soit une baisse de qualité qui passe inaperçue. Cet article confronte le texte original de la documentation officielle et de l'annonce, et passe en revue ce qui a changé, ce que cela coûte et ce qui casse pendant la migration, dans l'ordre où vous aurez à vous en occuper.

Informations à jour au 24 septembre 2026 : article rédigé deux jours après la sortie, après lecture du texte original de la documentation Claude Platform (vue d'ensemble des modèles, page d'Opus 5.5, What's new, guide de migration et tarifs), de l'annonce d'Anthropic, ainsi que de la documentation et du CHANGELOG de Claude Code. Claude Sonnet 5.5 et Claude Haiku 5.5, que l'annonce promet d'ici quelques semaines, n'étaient pas encore sortis à cette date.

CLAUDE OPUS 5.5 — 2026.09.22

Une baisse de prix et quatre ruptures, en même temps

— Présenté officiellement comme un modèle pour le codage agentique de longue durée et le travail intellectuel

ID du modèle
claude-opus-5-5
Sans suffixe de date (vue d'ensemble officielle des modèles)
Prix (par million de tokens)
$4 / $20
Opus 5 : $5 / $25 (page officielle des tarifs)
Effort par défaut
medium
high sur Opus 5. Thinking toujours actif (documentation officielle)
Attention
4 ruptures de compatibilité
Classées comme breaking changes par Anthropic
Source : annonce officielle d'Anthropic et documentation Claude Platform (22 septembre 2026)

1. L'essentiel d'Opus 5.5 : performances, prix, pièges de migration

① Performances

Dans le tableau comparatif d'Anthropic, il obtient des scores supérieurs à Fable 5.1 en codage agentique, en travail intellectuel et en utilisation d'ordinateur. L'annonce elle-même le situe au niveau de Fable 5.1 pour la plupart des tâches. La même annonce précise aussi qu'à ce niveau, les écarts de benchmark ne sont plus un guide fiable des différences en conditions réelles.

② Tarifs

L'entrée et la sortie sont 20 % moins chères qu'Opus 5, à $4 / $20, et la lecture en cache est 60 % moins chère, à $0.20. Face à Sonnet 5, en revanche, l'entrée et la sortie coûtent deux fois plus, tandis que la lecture en cache coûte le même prix. Ce que « moins cher » veut dire dépend de la comparaison.

③ Pièges de migration

Il y en a quatre : impossible de désactiver le thinking / l'utilisation forcée d'outils renvoie 400 / les blocs de thinking sont liés au modèle et à la conversation / l'ancien outil de computer use disparaît. En plus, l'effort par défaut descend à medium, et le texte entre deux appels d'outils passe dans des blocs de thinking.

En une phrase, Opus 5.5 est « un Opus moins cher, qui se manie comme Fable 5.1 ». Pour trois des quatre ruptures, la documentation officielle indique elle-même qu'elles s'appliquent aussi à Claude Fable 5.1. Si votre code est déjà passé par une migration vers Fable 5.1, il vous reste beaucoup moins de travail.

2. Caractéristiques et plateformes disponibles

Commençons par les chiffres. La comparaison porte sur trois modèles : Opus 5, qu'il remplace ; Fable 5.1, la gamme au-dessus ; et Sonnet 5, la gamme en dessous.

Élément Opus 5.5 Opus 5 (Legacy) Fable 5.1 Sonnet 5
ID du modèle dans l'API claude-opus-5-5 claude-opus-5 claude-fable-5-1 claude-sonnet-5
Prix (entrée/sortie) $4 / $20 $5 / $25 $10 / $50 $2 / $10
Contexte / sortie maximale 1M / 128K 1M / 128K 1M / 128K 1M / 128K
Thinking Toujours actif (non désactivable) Actif par défaut. Désactivable à un effort high ou inférieur Toujours actif (non désactivable) Actif par défaut. Désactivable à n'importe quel effort
Effort par défaut medium high high high
Limite de connaissances fiable Juin 2026 Mai 2026 Juin 2026 Janvier 2026
Vitesse (libellé relatif officiel) Moderate Slower Fast
Retrait Pas avant le 22 septembre 2027 Pas avant le 24 juillet 2027 Pas avant le 1er septembre 2027 Pas avant le 30 juin 2027

Sources : Anthropic, « Models overview », « Claude Opus 5.5 », « Claude Opus 5 », « Migrating to Claude Opus 5.5 » (consultés le 24 septembre 2026). La vitesse est un libellé relatif au sein de la gamme actuelle ; elle n'est pas indiquée pour Opus 5, passé en Legacy. Les dates de retrait sont des engagements valables pour les plateformes opérées par Anthropic ; Amazon Bedrock et Google Cloud fixent les leurs.

Ce qui frappe dans ce tableau, c'est que seules deux lignes, « Thinking » et « Effort par défaut », diffèrent d'Opus 5. Le contexte et la sortie maximale sont identiques, et la limite de connaissances n'avance que d'un mois. Sur la fiche technique, ce qui le distingue d'Opus 5, c'est la façon de le manier et ce qu'il coûte ; l'écart de performances est traité dans le tableau de la section 4. À noter également : avec la Message Batches API, l'en-tête bêta output-300k-2026-03-24 porte la limite de sortie à 300K tokens (comme pour Opus 5).

Plateformes

API / cloud

API Claude (claude-opus-5-5), Amazon Bedrock (anthropic.claude-opus-5-5), Claude Platform on AWS, Google Cloud et Microsoft Foundry. Il est sorti sur toutes les plateformes dès le premier jour.

Applications / outils de développement

claude.ai, les applications iOS et Android, et Claude Code. Dans Claude Code, il est devenu le modèle par défaut des principales offres, Pro compris, à partir de la v2.1.280 (section 9).

Limites du mode rapide

La variante rapide est en research preview, et la documentation officielle la réserve à l'API Claude uniquement. Elle n'est disponible ni sur Bedrock, ni sur Claude Platform on AWS, ni sur Google Cloud, ni sur Microsoft Foundry.

3. Tarifs : moins cher qu'Opus 5, mais tout dépend du point de comparaison

La page officielle What's new annonce un prix de $4 / $20, inférieur aux $5 / $25 d'Opus 5. C'est la première modification du tarif Opus depuis que les $5 / $25 se sont maintenus d'Opus 4.5 jusqu'à Opus 5 (vérifié dans le tableau de la page officielle des tarifs). Voici le détail.

Par million de tokens Opus 5.5 Opus 5 Fable 5.1 Sonnet 5
Entrée $4 $5 $10 $2
Sortie $20 $25 $50 $10
Écriture en cache (5 min) $5 $6.25 $12.50 $2.50
Écriture en cache (1 heure) $8 $10 $20 $4
Lecture en cache $0.20
5 % de l'entrée
$0.50
10 % de l'entrée
$0.25
2,5 % de l'entrée
$0.20
10 % de l'entrée
Batch API (entrée/sortie) $2 / $10 $2.50 / $12.50 $5 / $25 $1 / $5
Mode rapide (entrée/sortie) $8 / $40 $10 / $50

Source : Anthropic, « Pricing » (consulté le 24 septembre 2026). La ligne du mode rapide ne couvre que les modèles figurant dans le tableau du mode rapide de la page des tarifs. Les $2 / $10 de Sonnet 5 ont été lancés comme tarif de lancement valable jusqu'au 31 août, puis sont devenus le prix standard (d'après une note de la même page).

« Moins cher » ne veut pas dire la même chose selon le modèle

Face à Opus 5, il est moins cher sur tous les postes. Face à Fable 5.1 ou Sonnet 5, en revanche, l'écart ne se répartit pas de façon égale entre les postes. Le graphique ci-dessous montre le tarif d'Opus 5.5 quand celui de l'autre modèle vaut 100.

Tarif d'Opus 5.5 quand celui de l'autre modèle = 100

Face à Opus 5
Entrée, sortie, écriture en cache
80
Lecture en cache
40
Face à Fable 5.1
Entrée, sortie, écriture en cache
40
Lecture en cache
80
Face à Sonnet 5
Entrée, sortie, écriture en cache
200
Lecture en cache
100

Source : calcul de cet article à partir des tarifs de la page « Pricing » d'Anthropic (la longueur des barres est à l'échelle, 200 correspondant à la pleine largeur)

Trois enseignements :

  • En venant d'Opus 5, plus la charge repose sur le cache, plus l'économie est grande. L'entrée et la sortie baissent de 20 %, la lecture en cache de 60 %. L'annonce souligne d'ailleurs que la lecture en cache représente l'essentiel du coût du travail agentique et du codage.
  • Face à Fable 5.1, l'écart est faible sur la lecture en cache. L'entrée et la sortie coûtent 40 % du prix de Fable 5.1, mais la lecture en cache est à $0.20 contre $0.25, soit seulement 20 % de différence.
  • Face à Sonnet 5, seule la lecture en cache coûte le même prix. L'entrée et la sortie sont deux fois plus chères, mais la lecture en cache est à $0.20 pour les deux : l'écart de prix se resserre à mesure que la part de tokens en cache augmente.

Exemple chiffré : une tâche avec 10M tokens lus en cache, 500K tokens en entrée et 300K tokens en sortie (les volumes de tokens sont une hypothèse de cet article ; le coût d'écriture en cache n'est pas compté)

  • Opus 5.5 : $2.00 + $2.00 + $6.00 = $10.00
  • Opus 5 : $5.00 + $2.50 + $7.50 = $15.00 (Opus 5.5 en coûte les deux tiers)
  • Fable 5.1 : $2.50 + $5.00 + $15.00 = $22.50
  • Sonnet 5 : $2.00 + $1.00 + $3.00 = $6.00 (Opus 5.5 coûte environ 1,7 fois plus, pas 2 fois)

Cette comparaison porte sur les tarifs à volume de tokens égal ; en pratique, chaque modèle consomme un nombre de tokens différent. Tarifs issus de la page « Pricing » d'Anthropic.

Autre point : le tarif par token et la facture sont deux choses différentes. Selon l'annonce d'Anthropic, avec les réglages par défaut, il coûte 40 % de moins qu'Opus 5 sur des tâches typiques, parce que le prix par token baisse et qu'il consomme aussi moins de tokens par tâche. C'est une mesure d'Anthropic elle-même. La documentation officielle indique par ailleurs qu'à effort égal, Opus 5.5 a tendance à réfléchir davantage par tour qu'Opus 5, surtout en xhigh et max. Les tokens de thinking sont facturés comme des tokens de sortie, même quand ils ne sont pas affichés. Les charges que vous faisiez tourner à moindre coût sur Opus 5 avec le thinking désactivé ne peuvent plus le désactiver sur Opus 5.5 : les tokens de sortie peuvent donc augmenter. Après la migration, le seul moyen de savoir est de mesurer usage et de refaire la comparaison sur votre propre charge. Les tarifs de tous les modèles Claude sont récapitulés dans notre comparatif des prix d'Opus, Sonnet et Haiku.

4. Benchmarks : des comparaisons limitées au tableau d'Anthropic

L'annonce d'Opus 5 présentait son tableau comparatif sous forme d'image, mais cette annonce utilise un tableau en texte sur la page. Il compte cinq colonnes : Opus 5.5, Fable 5.1, Opus 5, GPT-6 Astra et GPT-5.6 Sol. D'abord, les conditions du tableau :

  • Sauf mention contraire, Opus 5.5 a été mesuré à l'effort maximal (max). Seule exception, Terminal-Bench 4.0 : Opus 5.5 en xhigh et GPT-6 Astra en high (chiffre publié par OpenAI), soit le meilleur score de chaque modèle
  • Les chiffres de GPT-6 Astra et GPT-5.6 Sol sur Terminal-Bench 4.0, ainsi que celui de GPT-6 Astra sur Terminal-Bench-Science 0.1, sont publiés par OpenAI. Pour les chiffres GPT des autres lignes, aucune note n'indique qui les a mesurés
  • Les chiffres d'AutomationBench ont été mesurés et publiés par Zapier (Opus 5.5 lors de l'évaluation en accès anticipé de Zapier ; Opus 5 et les deux modèles GPT d'après le classement public de Zapier). C'est la seule ligne dont le tableau indique explicitement une mesure par un tiers
  • Opus 5.5 a été mesuré avec les mêmes garde-fous actifs qu'en production. Sur les problèmes où un garde-fou est intervenu, c'est Opus 4.8 qui les a résolus pour la cybersécurité, et Opus 5 pour la biologie et le développement de LLM de pointe. Anthropic précise que cela tire probablement les scores d'Opus 5.5 vers le bas
Benchmark Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0
Codage agentique dans le terminal
66,4 % 55,8 % 52,3 % 57,9 % 37,3 %
FrontierCode v1.1 (Main)
Les modifications sont-elles fusionnées ?
54,4 % 50,3 % 48,0 % 53,3 % 47,5 %
CursorBench 4.0
Tâches ambiguës sur plusieurs fichiers
57,8 % 51,8 % 46,6 % 41,7 %
GDPval-AA v2.1 (Elo)
Travail réel dans 44 métiers
1846 1735 1708 1542 1588
AutomationBench
Processus métier (mesuré par Zapier)
40,0 % 31,4 % 26,9 % 41,4 % 28,8 %
Humanity's Last Exam
Raisonnement multidomaine (avec outils)
67,7 % 65,6 % 63,6 % 57,2 %
Terminal-Bench-Science 0.1
Recherche scientifique agentique
58,7 % 52,6 % 29,0 % 64,6 % 22,4 %
OSWorld 2.0
Utilisation d'ordinateur (marqué « partial » dans le tableau)
81,8 % 80,7 % 74,0 %
Chartography
Lecture de graphiques (avec outils)
89,0 % 88,4 % 83,4 %

Source : tableau comparatif de « Introducing Claude Opus 5.5 » d'Anthropic (22 septembre 2026 ; consulté le 24 septembre). En vert, Opus 5.5 obtient le meilleur score de la ligne ; en rouge, le même tableau contient un score supérieur à celui d'Opus 5.5 sur la ligne. « — » signifie que le tableau ne donne pas de valeur.

Opus 5.5 obtient le meilleur score sur 7 des 9 lignes. Les plus grands écarts concernent Terminal-Bench 4.0 (10,6 points devant Fable 5.1) et GDPval-AA v2.1 (111 points devant Fable 5.1). Par rapport au précédent Opus 5, Terminal-Bench-Science 0.1 passe de 29,0 % à 58,7 %, soit environ le double.

Les scores par niveau d'effort, d'après les descriptions des graphiques de l'annonce

Les valeurs du tableau sont mesurées en max (xhigh pour Terminal-Bench 4.0), mais l'annonce contient aussi des graphiques qui placent le score en regard du coût par tâche à chaque niveau d'effort, et leurs descriptions donnent des chiffres au réglage par défaut, medium.

FrontierCode v1.1

54,6 % en medium. Il bat le meilleur score de GPT-6 Astra (53,3 %) pour environ un cinquième du coût par tâche. Le score en medium dépasse celui en max du tableau (54,4 %).

CursorBench 4.0

52,5 % en medium. C'est plus que Fable 5.1 (max) à 51,8 % et Opus 5 (max) à 46,6 %, et 11 points de plus que le meilleur score de GPT-5.6 Sol (41,7 %) pour environ un tiers du coût.

Terminal-Bench 4.0

À l'effort par défaut, il bat Opus 5 en max pour environ un cinquième du coût. Il égale GPT-6 Astra pour environ 40 % du coût.

GDPval-AA v2.1

En medium, il bat GPT-6 Astra en max pour environ un cinquième du coût par tâche.

Source : descriptions des graphiques de « Introducing Claude Opus 5.5 » d'Anthropic (toutes les mesures et comparaisons sont celles d'Anthropic)

FrontierCode mérite qu'on s'y arrête. Au sein de la même annonce, medium (54,6 %) dépasse légèrement max (54,4 %). Le constat observé depuis Opus 5, selon lequel augmenter l'effort n'augmente pas toujours le score, se prolonge avec Opus 5.5 (section 6). Pour l'annonce et les chiffres de GPT-6 Astra lui-même, voir notre analyse de la sortie de GPT-6 Astra.

5. Là où il ne gagne pas, et comment lire le tableau

Les articles de sortie ont tendance à ne citer que les lignes où le modèle l'emporte ; voici donc l'autre versant. Tout ce qui suit provient de l'annonce et de la documentation d'Anthropic.

GPT-6 Astra devant sur les processus métier et la science

Dans le tableau d'Anthropic lui-même, GPT-6 Astra passe devant sur AutomationBench, 40,0 % contre 41,4 %, et sur Terminal-Bench-Science 0.1, 58,7 % contre 64,6 %. À noter : AutomationBench a été exécuté sans modèle de repli, et les interventions des garde-fous ont été comptées comme des échecs (d'après la note du tableau).

La cybersécurité passe par un autre modèle

Invoquant des capacités cyber très élevées, l'annonce indique appliquer des garde-fous proches de ceux de Fable 5.1 et rediriger la majeure partie du travail de cybersécurité vers Opus 4.8. Trouver et corriger des bugs dans le développement courant fonctionne toujours normalement.

La recherche en biologie est aussi restreinte

La biologie reçoit les mêmes garde-fous que Fable 5.1. Pour l'utiliser en recherche et développement, il faut postuler au Life Sciences Verification Program, réservé aux organisations vérifiées.

Deux points à garder en tête en lisant le tableau : d'abord, l'annonce elle-même reconnaît qu'à ce niveau de performance, les écarts de benchmark deviennent un guide peu fiable des différences réelles, et qu'en usage interne chez Anthropic, l'écart avec Fable 5.1 paraît plus faible que ne le suggèrent les chiffres. Mieux vaut ne pas lire « 10 points devant Fable 5.1 » comme 10 points d'écart en pratique. Ensuite, les versions des tests diffèrent de celles du tableau de l'annonce d'Opus 5 (CursorBench 3.2 → 4.0, GDPval-AA v2 → v2.1, etc.). Si vous alignez des chiffres tirés du tableau de juillet et de celui-ci, vous comparez des valeurs mesurées dans des conditions différentes.

6. Ce que change l'effort medium par défaut

C'est le changement le plus facile à manquer. Une requête qui ne précise pas d'effort tourne en high sur Opus 5 et en medium sur Opus 5.5. Avec exactement le même code, le modèle réfléchit un cran moins profondément.

① Sans réglage, on descend d'un cran

La page officielle sur l'effort indique que spécifier explicitement la valeur par défaut (medium sur Opus 5.5) revient exactement au même que d'omettre l'effort. Pour retrouver la profondeur d'Opus 5, indiquez high explicitement.

② Même nom, pas la même profondeur

À effort égal, Opus 5.5 a tendance à réfléchir davantage par tour qu'Opus 5, surtout en xhigh et max (What's new). Reprendre le high d'Opus 5 ne donne pas forcément le même résultat.

③ C'est désormais le seul levier

Comme le thinking ne peut pas être coupé, l'effort est le seul paramètre qui agit sur la quantité de réflexion et sur le coût. Là où vous désactiviez le thinking sur Opus 5, baissez plutôt l'effort.

Quel niveau choisir, alors ? Voici les recommandations de la documentation officielle, résumées pour Opus 5.5.

effort Usage recommandé (description officielle) Remarques pour Opus 5.5
low Tâches simples où la vitesse et le coût priment, comme les sous-agents Candidat pour remplacer les charges qui désactivaient le thinking sur Opus 5
medium (par défaut) Travail agentique qui demande un équilibre entre vitesse, coût et performances Le niveau qui a battu les meilleurs scores des concurrents sur FrontierCode et CursorBench dans les graphiques de l'annonce
high Raisonnement complexe, codage difficile et travail agentique La valeur par défaut d'Opus 5. Une base de comparaison pratique juste après la migration
xhigh Codage agentique de longue durée Commencer avec max_tokens à 64K tokens et ajuster ensuite (guide de migration)
max Problèmes difficiles qui exigent le raisonnement le plus poussé La documentation de Claude Code prévient que les gains ont tendance à plafonner et que le modèle est sujet à la surréflexion : testez avant de l'utiliser à grande échelle

Sources : Anthropic, « Effort », le guide de migration, Claude Code, « Model configuration »

Le conseil officiel est constant : ne reprenez pas les réglages du modèle précédent ; réajustez l'effort sur votre propre jeu d'évaluation. L'annonce cite aussi des entreprises ayant testé le modèle en avant-première, comme Deloitte, selon qui, même à l'effort le plus bas, il a trouvé plus de bugs connus qu'Opus 5 en high ; mais ce sont des résultats que chaque entreprise a mesurés sur son propre travail et qu'Anthropic a choisi de publier, sans garantie que votre charge se comporte de la même façon. Vérifiez sur votre propre travail si medium tient la route en qualité, et ce qui s'améliore quand vous passez en high. Sur Opus 5.5, vous pouvez aussi changer l'effort message par message en cours de conversation sans casser le cache du prompt (bêta).

7. Quatre points qui cassent en venant d'Opus 5, et leurs correctifs

La page officielle What's new in Claude Opus 5.5 liste quatre ruptures de compatibilité qui touchent le code tournant sur Opus 5. Toutes renvoient une erreur 400 invalid_request_error.

① Impossible de désactiver le thinking

Opus 5 acceptait thinking: {"type": "disabled"} à un effort high ou inférieur. Sur Opus 5.5, le thinking est toujours actif, et aussi bien disabled qu'un budget manuel, {"type": "enabled", "budget_tokens": N}, renvoient une erreur à tous les niveaux d'effort. Le message renvoyé est le suivant :

"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

Correctif : supprimez le paramètre thinking (il est alors traité comme {"type": "adaptive"}). Là où vous désactiviez le thinking pour économiser, baissez plutôt l'effort.

# Avant : fonctionne sur Opus 5, renvoie 400 sur Opus 5.5
client.messages.create(
    model="claude-opus-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    messages=[...],
)

# Après : thinking toujours actif ; l'effort en règle la quantité
client.messages.create(
    model="claude-opus-5-5",
    max_tokens=16000,
    output_config={"effort": "low"},
    messages=[...],
)

Comme le thinking tourne toujours, une réponse peut commencer par un bloc de thinking. Le code qui lit par position, comme content[0].text, va casser : sélectionnez les blocs dont le type vaut "text". Dans les boucles d'outils, renvoyez les blocs de thinking tels quels, même vides (les modifier, les réordonner ou en retirer une partie renvoie 400). max_tokens plafonne le thinking et la réponse ensemble : les charges qui avaient le thinking désactivé doivent revoir leur limite.

② L'utilisation forcée d'outils renvoie une erreur

Régler tool_choice sur {"type": "any"} ou {"type": "tool", "name": "..."} renvoie 400. L'API de comptage des tokens applique la même vérification. Seuls auto (par défaut) et none sont acceptés.

tool_choice: type "tool" and "any" are not supported for this model.

Correctif : laissez tool_choice sur auto et ajoutez strict: true aux définitions d'outils (strict tool use), ou déplacez le schéma vers les structured outputs. Puis indiquez dans le prompt quand l'outil doit être utilisé. Si vous forciez l'utilisation d'un outil uniquement pour garantir une sortie JSON, passer aux structured outputs est la solution la plus propre. Une réserve : le strict tool use n'accepte qu'un sous-ensemble de JSON Schema, et chaque objet du schéma doit porter additionalProperties: false.

# Après : auto + strict ; dire en toutes lettres quand utiliser l'outil
client.messages.create(
    model="claude-opus-5-5",
    max_tokens=1024,
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[{"role": "user",
               "content": "Quel temps fait-il à Paris ? Utilise l'outil get_weather."}],
)

③ Les blocs de thinking sont liés au modèle et à la conversation

Chaque bloc de thinking enregistre le modèle qui l'a produit. Opus 5.5 peut lire les blocs de thinking des modèles Opus, Sonnet et Haiku jusqu'à Opus 5, mais pas ceux de Fable ni de Mythos. Dans l'autre sens, seuls Fable 5.1 et Mythos 5.1 sur l'API Claude peuvent lire les blocs de thinking d'Opus 5.5.

  • Passer d'Opus 5 à Opus 5.5, ou d'Opus 5.5 à Fable 5.1 (API Claude) conserve le raisonnement antérieur
  • Tout autre changement (par exemple Opus 5.5 → Sonnet 5) signifie que les tours suivants se déroulent sans le raisonnement du modèle précédent. La requête elle-même aboutit, et les blocs écartés ne sont pas facturés

Par ailleurs, l'API vérifie que rien de ce qui précède un bloc de thinking d'Opus 5.5 (system, tools, messages antérieurs) n'a changé depuis la création du bloc. Pour les comptes créés le 31 août 2026 à 00:00 (UTC) ou après, cette vérification est appliquée par défaut, et renvoyer des blocs par-dessus un historique réécrit en cours de conversation renvoie 400.

Correctif : faites avancer la conversation uniquement par ajout. Pour modifier des instructions ou des outils, utilisez un message système en cours de conversation au lieu de réécrire l'historique. D'après le guide de migration, Claude Code, claude.ai, Claude Managed Agents et le Claude Agent SDK fonctionnent déjà par ajout seul : si vous construisez par-dessus, rien à changer. Si la réécriture est inévitable, ajoutez l'en-tête bêta thinking-binding-controls-2026-08-01 et réglez thinking.block_binding.prefix_mismatch_behavior sur "drop_block" pour que les blocs concernés soient écartés au lieu de provoquer une erreur. Le mécanisme est le même que dans Fable 5.1, que nous avons détaillé dans notre article sur les ruptures de compatibilité de Fable 5.1.

④ L'ancien outil de computer use n'est plus disponible sur l'API Claude et Google Cloud

Opus 5 acceptait le computer use à la fois via le nouveau toolset computer_toolset_20260801 et via l'ancien outil computer_20251124 avec un en-tête bêta. Opus 5.5 sur l'API Claude et Google Cloud n'accepte que le toolset, et déclarer l'ancien outil renvoie 400. Le message commence ainsi :

'claude-opus-5-5' does not support tool types: computer_20251124.

Correctif : retirez l'en-tête bêta et remplacez tools par [{"type": "computer_toolset_20260801"}] (sans nom ni taille d'écran). La boucle de l'agent doit aussi changer, à trois endroits : le type d'action se trouve dans le name du bloc, et non dans input.action ; un même tour peut contenir plusieurs actions ; et chaque résultat doit être renvoyé avec toolset_name. Sur Amazon Bedrock, l'ancien outil continue de fonctionner avec Opus 5.5 : aucun changement n'y est nécessaire.

8. Les changements qui ne déclenchent aucune erreur

Les quatre ruptures renvoient une erreur 400 : vous les remarquerez. Les plus sournois sont les changements où seul le comportement évolue, sans aucune erreur.

Changement Ce qui se passe / que faire
Le texte entre les appels d'outils passe dans des blocs de thinking Les courtes phrases du type « Je vais maintenant vérifier X », qui étaient des blocs de texte sur Opus 5, reviennent désormais sous forme de blocs de thinking de progression. Avec le réglage d'affichage par défaut (display: "omitted"), ils sont vides : les interfaces qui diffusaient la progression aux utilisateurs deviennent muettes entre deux appels d'outils. Réglez display sur "updates" (bêta, en-tête thinking-display-updates-2026-08-18 ; ne renvoie que la progression, le raisonnement restant masqué) ou sur "summarized" (renvoie des résumés du raisonnement mêlés à la progression), et affichez les blocs de thinking non vides avant le tool_use qui les suit
Davantage de catégories de refus Un classifieur biologie tourne désormais à côté du classifieur cyber, et les requêtes qui cherchent à faire écrire au modèle son raisonnement interne dans la réponse peuvent être refusées au titre de reasoning_extraction. Un refus arrive en HTTP 200 avec stop_reason: "refusal" : lisez stop_details pour le traiter. Le repli côté serveur (fallbacks: "default", bêta) ne relance pas sur reasoning_extraction
Lecture plus précise des graphiques et des figures Il lit désormais correctement, même sans outils, les images contenant des graphiques détaillés ou dont le contenu dépend de la mise en page. Les contournements de prompt ajoutés pour les anciens modèles peuvent ne plus être nécessaires (ajouter des outils améliore toutefois encore la précision sur les entrées les plus fines)
En venant d'Opus 4.8 : pas de Priority Tier Opus 4.8 prend en charge le Priority Tier, mais pas Opus 5.5. Les organisations sous contrat doivent planifier leur capacité séparément

Sources : What's new in Claude Opus 5.5, Migrating to Claude Opus 5.5

9. Ce qui change dans Claude Code et claude.ai

Cette partie concerne ceux qui n'appellent pas l'API directement. Claude Code a ajouté la prise en charge d'Opus 5.5 dans la v2.1.280 du CHANGELOG.

Opus 5.5 devient le modèle par défaut

default désigne désormais Opus 5.5 sur Pro, Max, Team, Enterprise et l'API. Pro et Team Standard utilisaient auparavant Sonnet 5 par défaut : pour eux, c'est un passage de Sonnet à Opus. L'alias opus pointe lui aussi vers Opus 5.5 sur l'API Claude, Claude Platform on AWS, Bedrock et Google Cloud. Les versions antérieures à la v2.1.280 ne peuvent pas l'utiliser : lancez claude update.

L'effort démarre en medium

Opus 5.5 démarre en medium. Le niveau d'effort enregistré avec /effort à l'époque d'Opus 5 n'est pas repris (ni le réglage enregistré par modèle, ni l'ancien effortLevel de premier niveau dans les paramètres utilisateur ne s'appliquent à Opus 5.5). Il reste en medium tant que vous n'en choisissez pas un autre dans /effort ou l'écran /model. La variable d'environnement CLAUDE_CODE_EFFORT_LEVEL et un effortLevel défini dans les paramètres de projet ou les paramètres gérés s'appliquent à tous les modèles.

Couper le thinking n'a aucun effet

Alt+T (Option+T sur macOS), alwaysThinkingEnabled et MAX_THINKING_TOKENS=0 restent sans effet sur Opus 5.5 et Fable. Depuis la v2.1.281, sur les modèles dont le thinking ne peut pas être coupé, Claude Code affiche une explication d'une ligne au lieu de basculer le réglage.

Les garde-fous peuvent vous faire changer de modèle

Quand un classifieur se déclenche, les requêtes de biologie sont relancées sur Opus 5 et celles de cybersécurité sur Opus 4.8, et la session reste sur ce modèle. Utilisez /model pour revenir en arrière. La documentation officielle indique que pour les tests d'intrusion, les CTF ou les bases de code très axées sur la biologie, cela se produit souvent dès la toute première requête.

Sources : Claude Code, « Model configuration » et le CHANGELOG (v2.1.280 et v2.1.281, consultés le 24 septembre 2026)

La façon dont Claude Code enregistre l'effort est expliquée dans notre guide du réglage de l'effort, et le fonctionnement du thinking lui-même dans thinking adaptatif ou étendu. D'après l'annonce d'Anthropic, le mode rapide (jusqu'à 2,5 fois plus rapide, $8 en entrée / $40 en sortie) est également disponible dans Claude Code.

claude.ai et les applications

Opus 5.5 est sélectionnable sur claude.ai et dans les applications iOS et Android depuis le jour de sa sortie (Anthropic a publié un prompt système d'Opus 5.5 daté du même jour). L'annonce indique aussi qu'en plus de la baisse de prix, Anthropic va relever les limites d'utilisation sur cinq heures pour Pro, Max, Team et Enterprise au siège, et offrir aux abonnés une réinitialisation des limites d'utilisation à utiliser quand ils le souhaitent. L'annonce ne chiffre pas l'ampleur de la hausse. Les prix par offre sont présentés dans notre comparatif des prix de Claude et ChatGPT.

10. Choisir entre Opus 5.5, Fable 5.1, Sonnet 5 et Opus 5

La recommandation de la vue d'ensemble officielle des modèles est brève : en cas de doute, commencez par Opus 5.5 ; prenez Fable 5.1 pour le raisonnement exigeant et le travail agentique de longue durée, ou si Opus 5.5 reste insuffisant après l'avoir évalué avec un effort élevé. En y ajoutant les tarifs et les contraintes de l'API, le choix se présente ainsi.

Choisir Opus 5.5
  • Vous voulez d'abord vous fixer sur un seul modèle (le point de départ officiel)
  • Codage agentique et travail intellectuel de longue durée
  • Vous êtes sur Opus 5 (moins cher sur tous les tarifs)
  • Le coût de Fable 5.1 vous pèse et vous voulez tester si Opus 5.5 suffit
Choisir Fable 5.1
  • La qualité reste insuffisante après avoir évalué Opus 5.5 en high ou au-dessus
  • Raisonnement exigeant, travail agentique très long
  • Pour les charges très axées sur le cache, l'écart de tarif est plus faible qu'en entrée/sortie ($0.25 contre $0.20)
Choisir Sonnet 5
  • Vous avez besoin de vitesse ou de gros volumes (libellé de vitesse officiel : « Fast »)
  • Vous voulez désactiver le thinking, ou continuer à forcer l'utilisation d'outils
  • L'entrée et la sortie coûtent moitié moins qu'Opus 5.5 (la lecture en cache coûte le même prix)
  • Son successeur, Sonnet 5.5, est annoncé pour les semaines à venir
Rester sur Opus 5
  • Comme solution d'attente, le temps de corriger les quatre points de la section 7
  • Il est en Legacy mais toujours disponible, avec un retrait pas avant le 24 juillet 2027
  • Tous ses tarifs sont plus élevés que ceux d'Opus 5.5 : peu de raisons d'y rester longtemps

En cas de doute, l'ordre est simple : ① faites tourner Opus 5.5 en medium et en high sur votre propre travail → ② si ce n'est pas suffisant, essayez xhigh → ③ si ça ne suffit toujours pas, passez à Fable 5.1 → et si medium s'avère largement suffisant, vérifiez si low ou Sonnet 5 feraient aussi l'affaire. Monter l'effort et monter en gamme sont deux façons de payer pour la qualité, et laquelle revient le moins cher pour le gain obtenu dépend du travail.

11. Étapes de migration (utilisateurs de l'API)

Voici, tirés de la checklist du guide de migration, les points qui s'appliquent en venant d'Opus 5, dans l'ordre où vous les traiterez. Claude Code propose aussi /claude-api migrate pour vous y aider (un skill intégré mentionné dans le guide de migration ; il confirme le périmètre avec vous avant de modifier quoi que ce soit).

  1. Remplacez l'ID du modèle claude-opus-5 par claude-opus-5-5 (anthropic.claude-opus-5-5 sur Bedrock)
  2. Retirez disabled et enabled (avec budget) de thinking, et choisissez plutôt un effort
  3. Indiquez l'effort explicitement (l'omettre revient à medium ; utilisez high pour retrouver la profondeur d'Opus 5)
  4. Remplacez any et tool dans tool_choice par auto avec le strict tool use, ou par les structured outputs
  5. Si vous utilisez le computer use sur l'API Claude ou Google Cloud, passez à computer_toolset_20260801 et corrigez la boucle
  6. Lisez les réponses en sélectionnant les blocs par type, et dans les boucles d'outils, renvoyez les blocs de thinking tels quels
  7. Si vous affichez la progression dans une interface, réglez display sur "updates" ou "summarized"
  8. Si vous réécrivez system, tools ou des messages passés en cours de conversation, passez à un fonctionnement par ajout seul
  9. Si vous routez des requêtes vers d'autres modèles, testez en partant du principe que le raisonnement d'Opus 5.5 ne sera pas transmis
  10. Gérez stop_reason: "refusal" et configurez des replis
  11. Revoyez max_tokens pour les charges qui avaient le thinking désactivé (commencez à 64K en xhigh et max)
  12. Mesurez à nouveau le coût et la latence à l'effort choisi

Source : points de la section « Every starting model » d'Anthropic, « Migrating to Claude Opus 5.5 », réordonnés dans l'ordre de travail

Si vous venez directement d'Opus 4.8 ou d'une version antérieure, vous devez aussi gérer le thinking qui tourne désormais sur des requêtes qui ne l'avaient jamais demandé. Il vaut la peine de consulter aussi les étapes de migration de notre analyse de la sortie d'Opus 5.

Conclusion

Claude Opus 5.5 est une sortie où une baisse de prix et un changement dans la façon de manier le modèle arrivent ensemble. Les tarifs baissent de 20 % en entrée et en sortie et de 60 % en lecture en cache, et dans le tableau comparatif d'Anthropic lui-même, il devance Fable 5.1 sur de nombreuses lignes. En revanche, le thinking ne peut plus être coupé, et l'utilisation forcée d'outils, l'ancien outil de computer use et la réécriture de l'historique provoquent désormais des erreurs 400.

Et la baisse de l'effort par défaut à medium passe facilement inaperçue, précisément parce qu'elle ne déclenche aucune erreur. Sur l'API, indiquez l'effort explicitement ; dans Claude Code, vérifiez que vos réglages d'Opus 5 n'ont pas cessé de s'appliquer sans prévenir. Savoir si la facture a vraiment baissé se mesure avec usage, pas avec les tarifs par token.

Enfin, les chiffres de benchmark sont des valeurs mesurées dans ce tableau, dans ces conditions. Sur AutomationBench et Terminal-Bench-Science, GPT-6 Astra est au-dessus dans le même tableau, et Anthropic reconnaît elle-même que l'écart avec Fable 5.1 est plus faible que ne le suggèrent les chiffres. Commencez par comparer medium et high sur votre propre travail.

FAQ

Q. Opus 5.5 est-il moins cher qu'Opus 5 ?

R. Les tarifs par token sont plus bas sur tous les postes ($4 en entrée, $20 en sortie, $0.20 en lecture en cache, contre $5, $25 et $0.50 pour Opus 5). Anthropic annonce 40 % d'économie sur des tâches typiques avec les réglages par défaut, mais c'est sa propre mesure. Les charges qui tournaient avec le thinking désactivé peuvent voir leurs tokens de sortie augmenter : vérifiez usage après la migration.

Q. Existe-t-il un moyen de couper le thinking ?

R. Non. Sur l'API, envoyer disabled renvoie 400, et Alt+T ou les réglages similaires de Claude Code n'ont aucun effet. Pour réduire la quantité de réflexion, réglez l'effort sur low. Si vous avez vraiment besoin de couper le thinking, Sonnet 5, qui permet de le désactiver à n'importe quel effort, est l'option à retenir.

Q. J'ai changé l'ID du modèle et j'obtiens une erreur 400.

R. Le message d'erreur indique de quel cas il s'agit. "thinking.type.disabled" ou "thinking.type.enabled" désigne le réglage du thinking, tool_choice: type "tool" and "any" l'utilisation forcée d'outils, et computer_20251124 l'ancien outil de computer use. Si ce n'est aucun de ces cas et que vous réécrivez l'historique en cours de conversation, soupçonnez la vérification des blocs de thinking (section 7, ③).

Q. Dans Claude Code, mon réglage d'effort d'Opus 5 ne semble pas s'appliquer.

R. C'est voulu. L'effort enregistré avec /effort est stocké par modèle, et ni le réglage d'Opus 5 ni l'ancien effortLevel de premier niveau dans les paramètres utilisateur ne s'appliquent à Opus 5.5. Opus 5.5 démarre en medium. Choisissez à nouveau avec /effort : le réglage sera enregistré pour Opus 5.5.

Q. Mon agent personnalisé n'affiche plus sa progression pendant qu'il travaille.

R. Sur Opus 5.5, le texte entre les appels d'outils revient dans des blocs de thinking, vides avec le réglage d'affichage par défaut. Réglez thinking.display sur "updates" (bêta) ou "summarized" et affichez les blocs de thinking non vides.

* Les chiffres de cet article s'appuient sur l'annonce officielle d'Anthropic « Introducing Claude Opus 5.5 » (benchmarks tirés du tableau comparatif et des descriptions des graphiques de cette page), sur la documentation officielle « Models overview », « Claude Opus 5.5 », « What's new in Claude Opus 5.5 », « Migrating to Claude Opus 5.5 » et « Pricing », ainsi que sur « Model configuration » et le CHANGELOG de Claude Code (tous consultés le 24 septembre 2026). Les spécifications et les tarifs peuvent évoluer : vérifiez les derniers détails dans la documentation officielle.

Articles liés : analyse de la sortie de Claude Opus 5, ruptures de compatibilité de Claude Fable 5.1 et migration.