Le 23 avril 2026, OpenAI a sorti « ChatGPT 5.5 (GPT-5.5) ». Présenté par OpenAI lui-même comme « une nouvelle classe d'intelligence pour le travail réel et les agents IA », le modèle à affiche 82.7% sur Terminal-Bench 2.0, devançant nettement Claude Opus 4.7 d'Anthropic (69.4%) et Gemini 3.1 Pro de Google (68.5%) et reprenant le SOTA (state of the art) sur 14 benchmarks au passage.

En contrepartie, le tarif public de l'API à double face à GPT-5.4 ($5/$30 par MTok), et Claude Opus 4.7 reste devant sur SWE-Bench Pro. La lecture honnête : « le plus fort, mais pas le meilleur partout. » On note aussi une tendance documentée a répondre avec assurance sur des choses qu'il ne sait pas vraiment — un point à surveiller pour les usages médicaux, juridiques ou regules.

En s'appuyant sur l'annonce officielle d'OpenAI, la documentation développeur OpenAI et plusieurs rapports de benchmark indépendants, cet article dresse le panorama complet : nouveautés, benchmarks, tarifs, disponibilité par plan, duel face à Claude et Gemini, et comment choisir le bon modèle selon votre besoin.

GPT

Lancement de GPT-5.5

Une nouvelle classe d'intelligence pour le travail réel et les agents IA

82.7%
Terminal-Bench 2.0
SOTA · dépasse Claude
14
Benchmarks SOTA
Claude: 4 / Gemini: 2
$5/$30
Prix API / 1M tokens
2× le prix de GPT-5.4

1. Vue d'ensemble — date, disponibilité, fiche technique

ÉlémentDétails
Nom officielGPT-5.5 (affiche « ChatGPT 5.5 » dans ChatGPT)
Date de sortie23 avril 2026
Conçu parOpenAI
VariantesGPT-5.5 (standard) / GPT-5.5 Pro (raisonnement profond)
Fenêtre de contexteAPI : 1 050 000 tokens (~1M) / Codex : 400K tokens
Sortie max128 000 tokens
Date butoir des connaissances1er décembre 2025
Tarif API (standard)$5 / 1M tokens (entrée) / $0.50 (entrée mise en cache) / $30 (sortie)
Tarif API (Pro)$30 (entrée) / $180 (sortie)
Surcharge prompts longsAu-delà de 272K tokens : entrée x2, sortie x1.5
ModalitésTexte en entrée/sortie, image en entrée (pas d'audio ni de vidéo)
Plans ChatGPTPlus / Pro / Business / Enterprise (pas sur Free)
Fonctionnalités clésFunction calling, sorties structurées, streaming, contrôle de l'effort de raisonnement, Computer Use, support MCP

2. Quoi de neuf — 5 améliorations clés

1. Réentraînement complet du modèle de base (première fois depuis GPT-4.5)

GPT-5.5 est le premier réentraînement complet du modèle de base depuis GPT-4.5. GPT-5, 5.1, 5.2 et 5.4 étaient tous des variantes fine-tunees sur la même base sous-jacente, mais GPT-5.5 a été reconstruit de zéro. Résultat : des gains à la fois sur l'efficacité du raisonnement et sur la mise à jour des connaissances.

2. Gros gains d'efficacité en tokens (~40% de réduction)

GPT-5.5 conserve la même latence par token que GPT-5.4 tout en réduisant d'environ 40% le nombre de tokens de sortie nécessaires pour accomplir des tâches Codex. Le tarif à double, mais comme le volume de sortie chute de 40%, OpenAI souligne que le coût total pour le même travail augmente généralement moins qu'on ne le pense.

Citation de Greg Brockman, cofondateur d'OpenAI :

« C'est un modèle qui pense plus vite et plus finement avec moins de tokens — ce genre de modèle, compare à quelque chose comme 5.4. »

3. Fenêtre de contexte d'environ 1M (API)

La version API monte à 1 050 000 tokens (~1M). L'intégration Codex est plafonnée à 400K. Environ 1M tokens, c'est à peu près 1 400 pages À4. Attention toutefois à la surcharge tarifaire : les prompts au-delà de 272K tokens déclenchent x2 sur l'entrée et x1.5 sur la sortie, donc les charges de travail à très long contexte demandent un calcul de coût en amont.

4. Contrôle de l'effort de raisonnement sur cinq niveaux

L'API expose reasoning.effort avec cinq réglages :

  • none : pas de raisonnement (le plus rapide, le moins cher)
  • low : raisonnement léger
  • medium : par défaut (équilibre)
  • high : raisonnement profond (tâches complexes)
  • xhigh : raisonnement maximal (le plus lent et le plus cher, précision maximale)

Cela rappelle le bouton output_config.effort de Claude Opus 4.7, et le secteur dans son ensemble convergé vers le « laisser l'appelant doser la profondeur du raisonnement ».

5. Expert-SWE a 73.1% — gère des tâches de l'ordre de 20 heures

Sur la nouvelle évaluation interne publiée par OpenAI, Expert-SWE (tâches de codage extrêmement complexes avec un temps médian de 20 heures pour un humain), GPT-5.5 atteint 73.1% — soit 5.6 points de plus que les 68.5% de GPT-5.4. C'est un gros bond pour la fiabilité des agents de codage autonomes à long horizon.

3. Benchmarks — duel avec Claude et Gemini

Comparaison des benchmarks GPT-5.5 (Top 5)

vs Claude Opus 4.7 / Gemini 3.1 Pro

GPT-5.5 Claude Opus 4.7 Gemini 3.1 Pro
Terminal-Bench 2.0
82.7% ← gagnant
69.4%
68.5%
OSWorld (automatisation PC)
78.7% ← gagnant
78.0%
Gemini : pas de données
SWE-Bench Pro
58.6%
64.3% ← gagnant
Gemini : pas de données
FrontierMath Tier 4
35.4% ← gagnant
22.9%
16.7%
Tau2-bench Telecom
98.0% ← gagnant
Claude / Gemini : pas de comparaison directe

Source : annonce officielle OpenAI (23 avril 2026)

BenchmarkGPT-5.5Claude Opus 4.7Gemini 3.1 ProVainqueur
Terminal-Bench 2.082.7%69.4%68.5%🥇 GPT-5.5
GDPval (44 métiers du travail intellectuel)84.9%🥇 GPT-5.5
OSWorld-Verified (automatisation PC)78.7%78.0%🥇 GPT-5.5 (de justesse)
BrowseComp84.4% (Pro : 90.1%)🥇 GPT-5.5 Pro
FrontierMath Tier 435.4% (Pro : 39.6%)22.9%16.7%🥇 GPT-5.5
SWE-Bench Pro58.6%64.3%🥇 Claude Opus 4.7
Tau2-bench Telecom (support client)98.0%🥇 GPT-5.5
GPQA Diamond93.6%🥇 GPT-5.5
Expert-SWE (interne OpenAI)73.1%🥇 GPT-5.5

Bilan : GPT-5.5 détient le SOTA sur 14 benchmarks, Claude sur 4, Gemini sur 2

Sur l'ensemble des benchmarks publiés par OpenAI, GPT-5.5 détient le SOTA sur 14 benchmarks, Claude Opus 4.7 sur 4 et Gemini 3.1 Pro sur 2. L'avantage global revient clairement à GPT-5.5.

Cela dit, sur SWE-Bench Pro (tâches de codage de niveau production), Claude Opus 4.7 garde la main avec 64.3% contre 58.6% pour GPT-5.5. Pour le travail de code, répartir les modèles selon la tâche reste pertinent.

Vérification tierce : évaluation de revue de code par CodeRabbit

Le service indépendant de revue de code CodeRabbit rapporte les améliorations suivantes pour GPT-5.5 :

  • Benchmark cure : détection des problèmes attendus 58.3% → 79.2%, précision 27.9% → 40.6%
  • Jeu de données réel : détection des problèmes 55.0% → 65.0%, précision 11.6% → 13.2%

Lecture de CodeRabbit : « le modèle préfère les modifications locales, préserve le comportement et tend à se concentrer sur les vrais points de défaillance ». Traduction : plutôt que des réécritures massives, il penche vers des corrections ciblées et précises.

4. GPT-5.5 vs GPT-5.5 Pro — lequel utiliser ?

ÉlémentGPT-5.5 (standard)GPT-5.5 Pro
Tarif API (entrée)$5 / 1M tokens$30 / 1M tokens (x6)
Tarif API (sortie)$30 / 1M tokens$180 / 1M tokens (x6)
BrowseComp84.4%90.1%
FrontierMath Tier 435.4%39.6%
Plans ChatGPTPlus / Pro / Business / EnterprisePro / Business / Enterprise uniquement
Idéal pourTâches du quotidien, codage, agentsRecherche scientifique, maths complexes, raisonnement profond

Comment choisir

  • Prenez GPT-5.5 standard : codage général, rédaction, agents, usages soucieux du coût
  • Prenez GPT-5.5 Pro : maths et recherche scientifique, rédaction d'articles, décisions complexes — la précision avant le coût

5. Tarification — pourquoi cette hausse x2 ?

Tarif API (GPT-5.5 standard)

ÉlémentPrixNotes
Entrée$5.00 / 1M tokensx2 par rapport à GPT-5.4
Entrée mise en cache$0.50 / 1M tokens1/10 de l'entrée standard
Sortie$30.00 / 1M tokensx2 par rapport à GPT-5.4
Prompts longs (>272K tokens)Entrée x2, sortie x1.5Appliqué à toute la session
Batch API / Flex50% de remisePour les charges asynchrones
Traitement prioritairex2.5Pour les exigences de faible latence
Traitement régional (résidence des données)+10%Pour les cas de conformité

Pourquoi cette hausse x2 ?

OpenAI n'a pas explique directement la hausse, mais les facteurs probables sont :

  1. Coût du réentraînement complet du modèle de base — la première reconstruction de zéro depuis GPT-4.5
  2. Tarification des gains de performance — améliorations significatives sur Terminal-Bench et d'autres
  3. L'efficacité en tokens compense une partie de la douleur — 40% de tokens de sortie en moins équilibrent partiellement la hausse du prix unitaire

Pour les charges dominées par la sortie, l'augmentation effective du coût revient à environ « x2 x 0.6 = x1.2 ». Mais pour les tâches dominées par l'entrée (résumés, analyses), on encaisse la hausse x2 de plein fouet — à garder en tête.

6. Disponibilité par plan ChatGPT

PlanMensuelGPT-5.5GPT-5.5 ProCodex
Free$0❌ Non❌ Non❌ Non
Plus$20/mois✅ Oui❌ Non✅ Oui
Pro$200/mois✅ Oui✅ Oui✅ Oui (Fast Mode inclus)
BusinessÀ l'usage✅ Oui✅ Oui✅ Oui
EnterpriseSur devis✅ Oui✅ Oui✅ Oui

Les utilisateurs Free restent sur GPT-5 (ou 5.4)

GPT-5.5 n'est pas disponible sur le plan Free — les utilisateurs Free continuent sur GPT-5 (ou 5.4). Plus ($20/mois) est le ticket d'entrée.

7. Spécifications API et fonctionnalités développeur

Fonctionnalités supportees

  • ✅ Function calling
  • ✅ Sorties structurées (JSON Schéma)
  • ✅ Streaming
  • ✅ Contrôle de l'effort de raisonnement (none/low/medium/high/xhigh)
  • ✅ Outils : recherche web, recherche de fichiers, génération d'images, Code Interpréter, Hosted Shell, Apply Patch, Skills, Computer Use, MCP, Tool Search
  • ✅ Distillation (vers des modèles plus petits)
  • ❌ Fine-tuning : non supporte au lancement
  • ❌ Audio / vidéo en entrée ou sortie : non supportés

Limites de débit (Tier 5 : le plus élevé)

  • RPM (requêtes par minute) : 15 000
  • TPM (tokens par minute) : 40 000 000
  • Limite de file batch : 15 000 000 000

Exemple d'effort de raisonnement (Python)

from openai import OpenAI
client = OpenAI()

response = client.responses.create(
    model="gpt-5.5",
    reasoning={"effort": "high"},  # none/low/medium/high/xhigh
    input="Resous ce probleme mathematique complexe etape par etape..."
)

print(response.output_text)

8. Intégration Codex et stratégie Super-app

Codex Fast Mode

En même temps que la sortie de GPT-5.5, Codex a reçu un Fast Mode :

  • Traitement x1.5 plus rapide
  • x2.5 du coût (en crédits)
  • Disponible sur les plans Pro / Business / Enterprise

La stratégie Super-app

OpenAI a également devoile une vision « Super-app » qui regroupe « ChatGPT + Codex + navigateur IA » dans une même offre. L'idée est de livrer le tout sous forme de package entreprise unique — ce qu'OpenAI appelle « un pas vers une informatique plus agentique et plus intuitive ».

Conceptuellement, c'est le schéma « package tout-en-un pour maximiser l'expérience développeur » des PaaS comme Vercel ou Next.js, transpose dans le domaine des agents IA.

9. GPT-5.5 vs Claude Opus 4.7 vs Gemini 3.1 Pro

GPT-5.5 vs Claude Opus 4.7 vs Gemini 3.1 Pro

Comparaison des trois derniers modèles frontières

GPT-5.5

Publié le 23 avril 2026

Prix (entrée/sortie)
$5 / $30 par MTok
Contexte
1 050 000 tokens
Benchmarks SOTA
14
Points forts
◎ Agents · pilotage PC
◎ Maths · recherche scientifique
◎ Automatisation du support client
Point faible
△ Tendance aux hallucinations
Claude Opus 4.7

Publié le 16 avril 2026

Prix (entrée/sortie)
$5 / $25 par MTok
Contexte
200K standard / 1M étendu
Benchmarks SOTA
4
Points forts
◎ SWE-Bench Pro 64,3 %
◎ Codage autonome de longue durée
◎ Sécurité · précision
Point faible
△ En retrait sur la force agentique globale
Gemini 3.1 Pro

Publié début 2026

Prix (entrée/sortie)
Non publié (par palier)
Contexte
1 000 000 tokens
Benchmarks SOTA
2
Points forts
◎ Multimodal sur tous les domaines
◎ Intégration Google Workspace
◎ Compréhension vidéo
Point faible
△ Codage légèrement plus faible
ÉlémentGPT-5.5Claude Opus 4.7Gemini 3.1 Pro
Sortie23 avril 202616 avril 2026Début 2026
API entrée$5/MTok$5/MTokNon communique
API sortie$30/MTok$25/MTokNon communique
Contexte1 050K1 000K (200K standard)1 000K
Date butoir des connaissances1er dec. 2025~début 2025~début 2025
Benchmarks SOTA1442
Terminal-Bench 2.082.7%69.4%68.5%
SWE-Bench Pro58.6%64.3%
FrontierMath T435.4%22.9%16.7%
Points fortsAgents, tâches de longue haleine, pilotage du PCSessions de codage longues, sécurité, rédaction de longue formeMultimodal, intégration Google Workspace

Comment choisir

  • Meilleur global + performances d'agent de pointe — GPT-5.5 (surtout si une sortie à >$30/MTok est acceptable)
  • Codage autonome long et travail orienté sécurité — Claude Opus 4.7 (gagne sur SWE-Bench Pro et à une sortie moins chère)
  • Intégration Google Workspace et multimodal — Gemini 3.1 Pro

10. Le revers — attention à l'excès de confiance

Une analyse indépendante (Handy AI) signale chez GPT-5.5 une tendance à « répondre avec assurance sur des choses qu'il ne sait pas vraiment ».

« Le modèle en sait plus, mais il répond aussi avec plus d'assurance sur des choses qu'il ne sait pas. »

Cas d'usage à risque élevé

  • ⚠️ Diagnostic médical ou prescriptions — une mauvaise information peut être vitale
  • ⚠️ Conseil juridique ou recherche de jurisprudence — citer des arrets hallucines pose un problème de deontologie
  • ⚠️ Conseil financier ou travail fiscal — exposition réglementaire
  • ⚠️ Citations dans la rédaction académique — cas connus de citation d'articles inexistants

Mitigations

  1. Vérification factuelle obligatoire — ne jamais utiliser la sortie de l'IA telle quelle ; recouper avec des sources primaires
  2. Utiliser l'outil de recherche web — forcer le modèle à chercher l'information en temps réel
  3. Recouper avec Claude Opus 4.7 — pour les travaux où la précision est critique, faire valider les réponses par plusieurs modèles
  4. Lui demander de dire « je ne sais pas » — instruire via le prompt système : « si tu n'es pas sur, dis-le explicitement »

11. Quand choisir GPT-5.5 — selon le cas d'usage

✅ Choisissez GPT-5.5 quand

  • Agents de codage autonomes à long horizon — Expert-SWE 73.1%, parmi les meilleurs du marche
  • Automatisation PC / Computer Use — OSWorld 78.7%, au niveau d'Opus 4.7
  • Automatisation du support client — Tau2-bench 98.0%, pratiquement parfait
  • Maths avancées et recherche scientifique — FrontierMath T4 35.4% (bien au-dessus des 22.9% d'Opus 4.7)
  • Vous êtes engagé dans l'écosystème OpenAI — intégré avec ChatGPT, Codex, Operator

❌ Passez votre tour quand

  • Codage de production de niveau SWE-Bench Pro — Claude Opus 4.7 reste devant
  • Travaux où la précision est critique (médical, juridique, financier) — gare aux hallucinations
  • Le coût est la priorité numéro un — $30/MTok en sortie, c'est le haut du panier
  • Vous voulez une option gratuite — pas disponible sur le plan Free
  • Traitement audio ou vidéo — texte + image en entrée uniquement

FAQ

Q1. Quand GPT-5.5 est-il devenu disponible dans ChatGPT ?

Le 23 avril 2026 (heure US), sur les plans Plus, Pro, Business et Enterprise. GPT-5.5 Pro est limité à Pro, Business et Enterprise.

Q2. Puis-je utiliser GPT-5.5 sur le plan Free ?

Non. Le plan Free reste sur GPT-5 (ou 5.4). Pour accéder à GPT-5.5, il faut au minimum le plan Plus à $20/mois.

Q3. GPT-5.5 vs Claude Opus 4.7 — lequel est meilleur ?

Globalement, GPT-5.5 (SOTA sur 14 benchmarks contre 4 pour Claude). Mais sur SWE-Bench Pro, Claude Opus 4.7 l'emporte 64.3% contre 58.6% — donc pour le codage de niveau production, Claude a l'avantage. Claude est aussi moins cher en sortie ($25/MTok contre $30/MTok pour GPT-5.5).

Q4. L'API à augmente — comment garder les coûts sous contrôle ?

Oui, $5/$30 par MTok, c'est x2 par rapport à GPT-5.4. Mais l'usage de tokens en sortie chute d'environ 40%, donc pour les charges dominées par la sortie, la hausse réelle se situe typiquement autour de x1.2. Pistes pour maîtriser le coût :
1. Utiliser Batch API / Flex (50% de remise)
2. Utiliser l'entrée mise en cache ($0.50/MTok, 1/10 du standard)
3. Utiliser reasoning.effort=low pour les tâches légères
4. Éviter les prompts au-delà de 272K tokens

Q5. Qu'est-ce qui distingue concrètement GPT-5.5 Pro ?

Il à un raisonnement plus puissant, avec des gains de score notables en maths complexes (FrontierMath : 35.4% → 39.6%) et sur les tâches de recherche scientifique. Le hic, c'est le prix — x6 sur le tarif API ($30 entrée / $180 sortie). En dehors de la recherche et de la rédaction d'articles sérieux, le rapport prix/performance n'est souvent pas au rendez-vous.

Q6. Le fine-tuning est-il supporte ?

Pas en avril 2026. La distillation (entraîner des modèles plus petits à partir des sorties) est supportee, donc vous pouvez utiliser les sorties de GPT-5.5 pour entraîner quelque chose comme GPT-5 nano.

Q7. Quoi surveiller quand on utilise le contexte 1M ?

Les prompts au-delà de 272K tokens déclenchent une surcharge de x2 sur l'entrée et x1.5 sur la sortie pour toute la session. Si vous concevez une API autour d'un usage de 1M tokens, faites tourner les chiffres de coût en amont.

Q8. Quelle est la date butoir des connaissances de GPT-5.5 ?

Le 1er décembre 2025. Tout ce qui suit (à partir de janvier 2026) n'est pas dans les données d'entraînement, donc l'outil de recherche web est de facto requis pour l'information actuelle.

Q9. Les hallucinations sont-elles améliorées ?

L'analyse indépendante dit : « la base de connaissances à grandi, mais l'assurance du modèle sur ce qu'il ne sait pas aussi ». OpenAI revendique officiellement des progrès en sécurité, mais pour le travail médical, juridique ou financier, la vérification factuelle reste obligatoire.

Q10. Mon application GPT-5 existante va-t-elle simplement fonctionner ?

La compatibilité API est préservée — il suffit de basculer l'identifiant de modèle de gpt-5 a gpt-5.5 pour migrer. Cela dit, tirer parti des nouvelles fonctionnalités (comme le paramètre reasoning.effort, ou le fait de specifier l'identifiant de la variante Pro) mérite une passe de conception.

Conclusion : GPT-5.5 est le plus fort, mais pas le meilleur partout

GPT-5.5 détient le SOTA sur 14 benchmarks et devance nettement Claude Opus 4.7 et Gemini 3.1 Pro pour reprendre la première place du secteur. Il est particulièrement fort sur les tâches d'agent, l'automatisation PC, le codage autonome de longue haleine et les maths et la recherche scientifique.

En même temps, il perd encore face à Claude Opus 4.7 sur SWE-Bench Pro, présente une tendance à « l'hallucination assurée » et arrive avec une hausse de prix x2 sur l'API — donc ce n'est pas une victoire sans condition.

Le jeu intelligent consiste à « choisir le bon — GPT-5.5, Claude Opus 4.7 ou Gemini 3.1 Pro — pour la tâche du moment ». Tout-en-un sur l'écosystème OpenAI ? GPT-5.5. Sessions de codage longues et travail orienté sécurité ? Claude. Intégration Google Workspace ? Gemini. L'exploitation multi-modèles devient le standard 2026.

Articles liés