Sommaire
- 1. Opus 5 en trois lignes
- 2. Caractéristiques et plateformes disponibles
- 3. Tarifs : inchangés, et moitié moins que Fable 5
- 4. Les benchmarks en détail
- 5. Là où il perd encore
- 6. Deux ruptures de compatibilité (thinking activé, effort limité)
- 7. Choisir parmi les cinq niveaux d'effort
- 8. Les autres nouveautés
- 9. Un caractère différent, et les prompts à corriger
- 10. Qui a intérêt à migrer tout de suite
- Conclusion
- FAQ
Le 24 juillet 2026, Anthropic a publié Claude Opus 5. Il arrive environ deux mois après Opus 4.8, et le numéro de version saute une génération entière, de 4.8 à 5. La documentation d'Anthropic parle elle-même d'un changement de palier plutôt que d'une amélioration incrémentale par rapport à Opus 4.8.
Voici la version courte. Le tarif ne bouge pas ($5 en entrée / $25 en sortie par million de tokens), et pourtant, sur les benchmarks agentiques, il égale ou dépasse le modèle phare Claude Fable 5 — facturé $10 / $50, ce qui revient à dire qu'Opus 5 fait le même travail pour moitié prix. En revanche, l'API introduit deux ruptures de compatibilité, et du code migré tel quel peut se heurter à des erreurs 400 ou à des réponses tronquées. Cet article recoupe l'annonce officielle et la documentation avec plusieurs articles de presse, et détaille les performances, les tarifs et les pièges de la migration du point de vue d'un praticien.
Même prix, un net cran au-dessus
— L'argument d'Anthropic : des performances de premier plan à moitié prix par rapport à Fable 5
1. Opus 5 en trois lignes
Gains importants sur le codage agentique, l'usage de l'ordinateur et les tâches de longue haleine. Sur le benchmark agentique en terminal Frontier-Bench v0.1, Anthropic annonce plus du double d'Opus 4.8 — avec un coût par tâche inférieur.
Aucune hausse. $5 en entrée / $25 en sortie par million de tokens, exactement comme Opus 4.8 — soit la moitié du modèle phare Fable 5 ($10 / $50).
Le thinking est désormais actif par défaut, et vous ne pouvez le désactiver qu'avec un effort high ou inférieur. Tout ce qui tourne avec un max_tokens serré risque d'être coupé en plein milieu.
En une phrase : Opus 5 fait presque le travail de Fable 5 au prix d'Opus 4.8. Ce qui implique aussi l'inverse — quand il vous faut la capacité maximale à l'état brut, Fable 5 et Mythos 5 gardent leur utilité (voir les faiblesses ci-dessous).
2. Caractéristiques et plateformes disponibles
Commençons par les chiffres. Voici les caractéristiques principales, d'après la liste officielle des modèles d'Anthropic.
| Élément | Claude Opus 5 | Claude Opus 4.8 (précédent) | Claude Fable 5 (modèle phare) |
|---|---|---|---|
| Identifiant API du modèle | claude-opus-5 |
claude-opus-4-8 |
claude-fable-5 |
| Tarif (entrée / sortie) | $5 / $25 | $5 / $25 | $10 / $50 |
| Fenêtre de contexte | 1M tokens (par défaut et maximum) | 1M tokens | 1M tokens |
| Sortie maximale | 128K tokens | 128K tokens | 128K tokens |
| Limite de connaissances fiable | Mai 2026 | Janvier 2026 | Janvier 2026 |
| Thinking | Actif par défaut | Inactif par défaut (activation explicite) | Toujours actif (non désactivable) |
| Niveaux d'effort | low / medium / high / xhigh / max | low / medium / high / xhigh / max | low / medium / high / xhigh / max |
Source : Anthropic, « Models overview » et « What's new in Claude Opus 5 » (état de juillet 2026)
La ligne que l'on survole souvent, mais que l'on sent au quotidien, c'est l'avancée de la limite de connaissances. Opus 4.8 et Fable 5 s'arrêtent en janvier 2026 ; Opus 5 va jusqu'en mai 2026. Cela représente plusieurs mois supplémentaires de versions de bibliothèques et d'évolutions de spécifications auxquelles il peut répondre de mémoire. Malgré tout, il ne connaît toujours pas « aujourd'hui » : ne le laissez jamais affirmer une actualité ou un changement de tarif récent sans recherche web.
Où l'utiliser
API Claude (claude-opus-5), Amazon Bedrock (anthropic.claude-opus-5), Google Cloud, Microsoft Foundry. Opus 4.8 reste disponible.
claude.ai, Claude Code et Claude Cowork. C'est le modèle par défaut du plan Max et le modèle le plus élevé sélectionnable sur Pro.
La variante haute vitesse est une préversion de recherche réservée à l'API Claude. Elle n'est aujourd'hui disponible ni sur Bedrock, ni sur Google Cloud, ni sur Microsoft Foundry.
3. Tarifs : inchangés, et moitié moins que Fable 5
Le fait le plus concret de cette sortie, c'est que les capacités ont augmenté sans que le prix bouge. La documentation d'Anthropic l'écrit noir sur blanc : $5 par million de tokens en entrée et $25 par million en sortie, soit exactement le tarif de Claude Opus 4.8.
Tarif par million de tokens (API Claude)
Source : Anthropic, « What's new in Claude Opus 5 » et « Pricing » (juillet 2026). Les tarifs de cache suivent les multiplicateurs officiels (écritures 1,25x et 2x, lectures 0,1x)
Ce qu'il faut vraiment intégrer, c'est que le prix au token et le coût par tâche sont deux choses différentes. Dans ses supports sur Opus 5, Anthropic met en avant des graphiques de coût par tâche, pas de prix unitaire. Sur le benchmark d'usage de l'ordinateur OSWorld 2.0, par exemple, l'annonce officielle indique qu'il dépasse le meilleur score de Fable 5 pour environ un tiers du coût. Un prix unitaire divisé par deux, plus des étapes inutiles évitées : l'écart réel se creuse beaucoup plus qu'on ne l'imagine.
Une réserve : puisque le thinking est désormais actif par défaut, un même prompt peut produire davantage de tokens de sortie et coûter plus cher. Si vous faisiez tourner quelque chose à bas coût sur Opus 4.8 avec le thinking désactivé et que vous vous contentez de changer l'identifiant du modèle, votre facture peut grimper. Mesurez réellement usage après la migration.
4. Les benchmarks en détail
L'annonce d'Anthropic est construite autour de graphiques plutôt que d'un tableau de chiffres : ce que la page énonce en toutes lettres reste donc essentiellement relatif — « plus du double », « à moins de 0,5 % ». Cet article sépare par conséquent les comparaisons qu'Anthropic formule dans son propre texte et les chiffres rapportés de façon concordante par plusieurs médias.
4-1. Les comparaisons énoncées directement par Anthropic
Travail agentique en terminal et en code. Il devance tous les autres modèles testés et atteint plus du double d'Opus 4.8, pour un coût par tâche inférieur.
À l'effort max, il se situe à moins de 0,5 % du meilleur score de Fable 5, pour environ moitié prix.
Une mesure de la résolution de problèmes véritablement inédits, où il obtient trois fois le score du deuxième.
Usage de l'ordinateur. Il devance la concurrence à tous les niveaux de prix et bat le meilleur score de Fable 5 pour environ un tiers du coût.
À coût égal, environ 1,5 fois le taux de réussite du deuxième. Anthropic affirme que même son réglage d'effort le plus bas dépasse le meilleur résultat des modèles concurrents.
Devant Opus 4.8 sur toutes les évaluations suivies par Anthropic, avec plus de 10 points de progression en chimie organique (lire des structures à partir de données spectrales, par exemple).
4-2. Les chiffres issus de la presse
Les valeurs ci-dessous proviennent de the decoder (24 juillet 2026) et de tech-ish (même jour), qui les ont l'un comme l'autre relevées sur les graphiques d'Anthropic. Seuls les points sur lesquels les deux médias concordent sont repris ici. À noter : ces chiffres ne figurent pas sous forme numérique dans le texte de la page officielle (signalés par un point jaune, « source presse »).
| Benchmark | Opus 5 | Fable 5 | GPT-5.6 Sol | Opus 4.8 |
|---|---|---|---|---|
| Frontier-Bench v0.1 Travail agentique en terminal |
43,3 % | 33,7 % | 34,4 % | environ 21 %🟡 |
| ARC-AGI-3 Résolution de problèmes inédits |
30,2 % | — | 7,8 % | 1,5 % |
| GDPval-AA v2 (Elo) Travail intellectuel réel |
1 861 | 1 747 | 1 736 | 1 593 |
| OSWorld 2.0 Agents d'usage de l'ordinateur |
70,6 % | 66,1 % | — | — |
| DeepSWE v1.1 Codage agentique |
68,8 % | 69,7 % | 72,7 % | — |
Le schéma n'a rien de subtil. Plus le modèle doit travailler longtemps en autonomie, plus l'écart se creuse — terminal, usage de l'ordinateur, automatisation métier, problèmes inédits. À l'inverse, sur le codage de type correctif unique (DeepSWE), il perd face à GPT-5.6 Sol. La même configuration que celle décrite dans notre comparatif avec GPT-5.6 Sol se rejoue un cran plus haut.
5. Là où il perd encore
Les articles de lancement n'énumèrent en général que les victoires ; faisons donc délibérément l'inverse. Voici les faiblesses qu'Anthropic reconnaît elle-même dans son annonce, plus les chiffres relevés par les journalistes.
Il a comblé l'écart avec Mythos 5 pour détecter les vulnérabilités, mais Anthropic indique clairement qu'il reste très en retrait sur l'écriture d'exploits. Le modèle défensif dédié reste la gamme Mythos.
Les sciences du vivant progressent sur toute la ligne, mais la documentation précise qu'il reste derrière Mythos 5 sur les travaux de recherche biologique autonomes de longue durée.
Sur DeepSWE v1.1, il obtient 68,8 %, derrière GPT-5.6 Sol à 72,7 %. Sur Humanity's Last Exam, c'est pratiquement une égalité : 56,3 % contre 56,5 % pour Fable 5 (source presse).
the decoder souligne que sur Frontier-Bench et le Coding Agent Index, l'effort max a obtenu un score inférieur aux réglages plus bas. Dépenser plus n'achète pas toujours plus.
Ce que cela change en pratique : mettre l'effort max par défaut peut alourdir la facture et faire baisser le score. La documentation elle-même suggère de démarrer à high ou xhigh, puis de tester en descendant jusqu'à medium sur votre propre jeu d'évaluation. Traitez l'effort comme un paramètre à ajuster, pas comme une constante réglée une fois pour toutes.
6. Deux ruptures de compatibilité (thinking activé, effort limité)
Si vous appelez l'API directement, c'est la section à ne surtout pas sauter. Les deux points qu'Anthropic classe parmi les « changements de comportement » peuvent casser votre code s'il migre sans modification.
Changement 1 : le thinking est actif par défaut
Sur Opus 4.8, omettre thinking revenait à s'exécuter sans réflexion. Sur Opus 5, l'omettre déclenche la réflexion — exactement comme si vous écriviez thinking: {"type": "adaptive"}.
# Le code qui s'exécutait sans thinking sur Opus 4.8... client.messages.create( model="claude-opus-5", max_tokens=1024, # plafonne désormais thinking + réponse ensemble messages=[...], ) # Sur Opus 5, il réfléchit d'abord : la réponse peut être coupée
max_tokens est un plafond appliqué aux tokens de réflexion et au texte de la réponse réunis. Tout ce qui dimensionnait max_tokens au plus juste par rapport à la longueur de réponse attendue verra désormais ce budget grignoté par la réflexion et se retrouvera tronqué. Au moment de migrer, il faut trancher : désactiver explicitement le thinking, ou donner plus de marge à max_tokens.
Changement 2 : le thinking ne se désactive qu'à l'effort high ou en dessous
Et cette option « désactiver » vient maintenant avec une limite. Combiner thinking: {"type": "disabled"} avec un effort xhigh ou max renvoie une erreur 400. Comme le contrôle se fait requête par requête, un code qui augmente l'effort en cours de route échoue de la pire manière : tout fonctionne, puis les erreurs surgissent d'un coup.
Thinking désactivé + effort low/medium/high
Thinking désactivé + effort xhigh/max
Laisser le thinking actif et baisser l'effort pour maîtriser le coût
Anthropic va plus loin et documente ce qui se passe mal quand on tourne effectivement sans thinking. Thinking désactivé, Opus 5 écrit parfois ses appels d'outils sous forme de texte — l'outil n'est donc jamais exécuté alors que le tour paraît réussi — et peut laisser fuiter des balises XML internes dans la sortie. Si vous construisez des agents, garder le thinking actif et abaisser l'effort est la voie la plus sûre.
7. Choisir parmi les cinq niveaux d'effort
Opus 5 prend en charge les cinq niveaux, low / medium / high / xhigh / max, et la valeur par défaut, dans l'API comme dans Claude Code, est high. Pour le paramétrage côté Claude Code, voyez notre guide du réglage d'effort.
| Effort | Adapté à | Remarques |
|---|---|---|
| low / medium | Traitements routiniers, classification, sous-agents exécutants, chemins sensibles à la latence | C'est ici qu'Anthropic insiste : « Opus 5 reste solide même à faible effort ». À essayer en premier |
| high (par défaut) | Travail général exigeant une vraie intelligence | Le choix sûr en cas de doute. Le point d'équilibre entre qualité et coût |
| xhigh | Le point de départ recommandé pour le code et les charges agentiques | Laissez beaucoup de marge à max_tokens (démarrez autour de 64K tokens) |
| max | Problèmes difficiles où la justesse compte plus que la facture | Le raisonnement le plus profond, mais pas toujours le meilleur résultat (voir la section 5) |
8. Les autres nouveautés
Changer la liste des outils en cours de conversation invalidait auparavant tout le cache de prompt. Opus 5 permet d'ajouter ou retirer des outils en conservant le cache (en-tête bêta mid-conversation-tool-changes-2026-07-01). Cela pèse lourd sur le coût des agents de longue durée.
La longueur minimale d'un prompt cachable passe de 1 024 à 512 tokens. Des prompts trop courts pour être mis en cache sur Opus 4.8 le deviennent sans aucune modification de code.
Lorsqu'une requête est refusée par les filtres de sécurité, au lieu d'énumérer vous-même des modèles de remplacement, vous pouvez laisser s'appliquer automatiquement le routage recommandé par Anthropic (en-tête bêta server-side-fallback-2026-07-01).
Une préversion de recherche offrant environ 2,5 fois la vitesse de sortie pour 2 fois le prix. API Claude uniquement — indisponible sur Bedrock, Google Cloud et Microsoft Foundry.
9. Un caractère différent, et les prompts à corriger
Vous le remarquerez sans doute avant tout benchmark. La documentation liste quatre changements de comportement visibles sans toucher une seule ligne de code.
| Changement | Que faire |
|---|---|
| Réponses et artefacts plus longs Réponses destinées à l'utilisateur, fichiers Markdown produits |
Demandez explicitement de la concision. Baisser l'effort ne raccourcit pas la prose : cela doit venir du prompt |
| Il commente davantage son travail | Supprimez les vieux échafaudages du type « résume l'avancement toutes les N étapes ». S'il reste bavard, dites-lui de rester silencieux par défaut entre les appels d'outils |
| Il délègue volontiers à des sous-agents Opus 4.8 y rechignait |
Retirez les incitations à « déléguer davantage » écrites pour 4.8. Plafonnez explicitement le parallélisme pour que le coût ne s'emballe pas |
| Il vérifie son travail spontanément | « Ajoute une étape de vérification à la fin » et « fais vérifier par un sous-agent » provoquent désormais une sur-vérification : supprimez-les (Anthropic le dit explicitement) |
Migrer, c'est retrancher, pas ajouter. Le texte que vous aviez ajouté à vos prompts pour compenser les faiblesses d'un modèle plus ancien — le pousser à vérifier, le pousser à déléguer, imposer des rapports d'avancement — devient un effet indésirable sur Opus 5. Enlevez tout cela d'abord, observez le comportement brut, puis ne remettez que ce qui vous manque vraiment.
10. Qui a intérêt à migrer tout de suite
- Vous exploitez des agents de codage au long cours
- Vous construisez des agents d'usage de l'ordinateur ou d'automatisation métier
- Vous êtes sur Fable 5 et le coût pèse (des performances proches pour moitié prix)
- Vous êtes encore sur Opus 4.8 (nettement meilleur au même prix)
- Les traitements routiniers tournant à bas coût avec le thinking désactivé et un
max_tokensréduit - Les étapes en aval qui dépendent de la longueur ou du style de la sortie
- Les prompts bourrés d'instructions de vérification et de délégation
- Surtout de la génération de correctifs uniques (gain faible, parfois une perte)
- Vous dépendez du mode rapide via Bedrock et consorts
- Tests de sécurité offensive ou recherche biologique de longue haleine (Mythos domine)
Étapes de migration (pour les utilisateurs de l'API)
- Remplacez l'identifiant de modèle
claude-opus-4-8parclaude-opus-5 - Repérez chaque endroit où vous désactivez le thinking (
thinking: disabled) ; avec un effort xhigh ou max, c'est désormais une erreur 400, donc baissez l'effort ou réactivez le thinking - Réexaminez
max_tokenspartout où vous ne définissez pasthinking(ajoutez de la marge pour les tokens de réflexion) - Supprimez de vos prompts les incitations à vérifier, à déléguer et les rapports d'avancement imposés
- Ajoutez une consigne de concision, puis réétalonnez le coût en mesurant réellement
usage - Balayez les efforts
medium/high/xhighet retenez le meilleur compromis sur votre propre jeu d'évaluation
Conclusion
Claude Opus 5 fait partie de ces sorties dont on profite sans arrière-pensée : un net progrès au même prix. L'écart est le plus large sur les agents qui travaillent en autonomie sur de longues durées, et Anthropic met en avant le coût par tâche pour défendre son argument : des performances de premier plan à moitié prix par rapport à Fable 5.
En parallèle, l'API comporte deux changements impossibles à ignorer (thinking actif par défaut ; désactivation du thinking réservée à un effort high ou inférieur). Et la clé d'une migration réussie tient en une phrase : on retire du texte de prompt plutôt qu'on n'en ajoute. Les consignes écrites pour rattraper les faiblesses d'un modèle plus ancien sont précisément ce qui rend Opus 5 bavard et excessivement prudent.
Enfin, rappelez-vous qu'un chiffre de benchmark n'est jamais que la valeur mesurée sur cette tâche-là. Opus 5 perd face à GPT-5.6 Sol sur DeepSWE, et il existe des cas où l'effort max n'est pas le meilleur réglage. Remesurez sur votre propre charge de travail : au bout du compte, c'est le seul chiffre qui tranche quoi que ce soit.
FAQ
Q. Opus 5 coûte-t-il plus cher qu'Opus 4.8 ?
R. Le prix au token est identique ($5 en entrée / $25 en sortie par million de tokens). Mais comme le thinking est actif par défaut, les tokens de sortie peuvent augmenter : votre facture réelle peut donc grimper. Mesurez usage après la migration.
Q. Faut-il choisir Fable 5 ou Opus 5 ?
R. Pour l'efficacité économique, Opus 5 : moitié prix au token et devant sur beaucoup de benchmarks agentiques. Pour le raisonnement le plus ardu et la recherche de longue haleine, Fable 5 garde l'avantage. Le cadre d'analyse de notre guide Fable 5 contre Opus se transpose directement.
Q. Puis-je l'utiliser avec le plan gratuit ?
R. Opus 5 est le modèle par défaut du plan Max et le modèle le plus élevé sélectionnable sur Pro. La structure des plans évolue : vérifiez la disponibilité actuelle sur la page tarifs d'Anthropic.
Q. J'ai migré et j'obtiens une erreur 400.
R. Vérifiez d'abord si vous envoyez thinking: {"type": "disabled"} en même temps qu'un effort xhigh ou max. Opus 5 rejette cette combinaison. Descendez l'effort à high ou en dessous, ou retirez le paramètre thinking (retour au comportement par défaut, actif).
Q. Les réponses sont trop longues. Baisser l'effort va-t-il les raccourcir ?
R. Non. L'effort contrôle surtout la profondeur de la réflexion ; il ne réduit pas de façon fiable la sortie destinée à l'utilisateur. La bonne solution consiste à demander explicitement de la concision dans le prompt.
Note : les chiffres de cet article proviennent de l'annonce d'Anthropic « Introducing Claude Opus 5 », de la documentation officielle « What's new in Claude Opus 5 » et « Models overview », ainsi que des articles de the decoder et de tech-ish (tous datés du 24 juillet 2026). Les valeurs marquées 🟡 ne figurent pas sous forme numérique dans le texte officiel et ont été relevées sur les graphiques par des journalistes : elles sont donc moins certaines. Les spécifications et les tarifs peuvent changer ; vérifiez tout point décisif dans la documentation officielle.