Em 23 de abril de 2026, a OpenAI lançou o "ChatGPT 5.5 (GPT-5.5)." Apresentado pela própria OpenAI como "uma nova classe de inteligência para trabalho real e agentes de IA," o modelo marcou 82.7% no Terminal-Bench 2.0, deixando para trás o Claude Opus 4.7 da Anthropic (69.4%) e o Gemini 3.1 Pro do Google (68.5%) e retomando o SOTA (state of the art) em 14 benchmarks no processo.

Ao mesmo tempo, o preço de tabela da API dobrou em relação ao GPT-5.4 ($5/$30 por MTok), e o Claude Opus 4.7 continua superior no SWE-Bench Pro. A leitura honesta e "o mais forte, mas não o melhor universal." Também há uma tendência documentada de responder com confiança sobre coisas que ele não sabe de fato — algo a se ter em mente em trabalho médico, jurídico ou regulado.

Com base no anúncio oficial da OpenAI, na OpenAI Developer Docs e em vários relatórios independentes de benchmark, este artigo entrega o panorama completo: o que há de novo, os benchmarks, preços, disponibilidade nos planos, como se compara com Claude e Gemini e como escolher o modelo certo para o que você está fazendo.

GPT

Lançamento do GPT-5.5

Uma nova classe de inteligência para trabalho real e agentes de IA

82.7%
Terminal-Bench 2.0
SOTA · supera o Claude
14
Benchmarks SOTA
Claude: 4 / Gemini: 2
$5/$30
Preço API / 1M tokens
2× o preço do GPT-5.4

1. Visão geral do lançamento — data, disponibilidade e ficha técnica

ItemDetalhes
Nome oficialGPT-5.5 (exibido como "ChatGPT 5.5" no ChatGPT)
Data de lançamento23 de abril de 2026
Desenvolvido porOpenAI
VariantesGPT-5.5 (padrão) / GPT-5.5 Pro (raciocínio profundo)
Janela de contextoAPI: 1.050.000 tokens (~1M) / Codex: 400K tokens
Saída máxima128.000 tokens
Corte de conhecimento1 de dezembro de 2025
Preço da API (padrão)$5 / 1M tokens (entrada) / $0.50 (entrada em cache) / $30 (saída)
Preço da API (Pro)$30 (entrada) / $180 (saída)
Sobretaxa de prompt longoAcima de 272K tokens: entrada 2x, saída 1.5x
ModalidadesTexto entrada/saída, imagem na entrada (sem áudio nem vídeo)
Planos do ChatGPTPlus / Pro / Business / Enterprise (não está no Free)
Recursos principaisFunction calling, saídas estruturadas, streaming, controle de esforço de raciocínio, Computer Use, suporte a MCP

2. O que há de novo — 5 melhorias principais

1. Re-treinamento completo do modelo base (o primeiro desde o GPT-4.5)

O GPT-5.5 e o primeiro re-treinamento completo do modelo base desde o GPT-4.5. GPT-5, 5.1, 5.2 e 5.4 eram todos variantes ajustadas (fine-tuned) do mesmo modelo base, mas o GPT-5.5 foi reconstruído do zero. O resultado são melhorias na eficiência de raciocínio e atualização de conhecimento ao mesmo tempo.

2. Grandes ganhos de eficiência em tokens (~40% de redução)

O GPT-5.5 mantém a mesma latência por token do GPT-5.4 enquanto reduz os tokens de saída necessários para concluir tarefas no Codex em cerca de 40%. O preço de tabela dobrou, mas como o volume de saída cai 40%, a OpenAI afirma que o custo total para o mesmo trabalho geralmente cresce menos do que se imagina.

Greg Brockman, cofundador da OpenAI:

"É um modelo que pensa mais rápido e mais afiado com menos tokens — esse tipo de modelo, comparado a algo como o 5.4."

3. Janela de contexto ~1M (API)

A versão da API expande para 1.050.000 tokens (~1M). A integração com o Codex e de 400K. ~1M tokens equivalem a aproximadamente 1.400 páginas A4 de texto. Só não esqueça da sobretaxa medida: prompts acima de 272K tokens incorrem em preço 2x na entrada e 1.5x na saída, então cargas de trabalho com contexto muito longo precisam de modelagem de custo.

4. Controle de esforço de raciocínio em cinco níveis

A API expõe reasoning.effort com cinco configurações:

  • none: sem raciocínio (mais rápido, mais barato)
  • low: raciocínio leve
  • medium: padrão (equilibrado)
  • high: raciocínio profundo (tarefas complexas)
  • xhigh: raciocínio máximo (mais lento e mais caro, maior precisão)

Isso espelha o controle output_config.effort do Claude Opus 4.7, e a indústria como um todo esta convergindo para "deixe o chamador ajustar a profundidade de raciocínio."

5. Expert-SWE em 73.1% — lida com tarefas da classe de 20 horas

Na nova avaliação interna publicada pela OpenAI Expert-SWE (tarefas de coding extremamente complexas com tempo mediano de 20 horas para um humano concluir), o GPT-5.5 alcançou 73.1% — um salto de 5.6 pontos sobre os 68.5% do GPT-5.4. E um avanço grande para a confiabilidade de agentes autônomos de coding em execução prolongada.

3. Benchmarks — comparativo direto com Claude e Gemini

Comparativo de benchmarks GPT-5.5 (Top 5)

vs Claude Opus 4.7 / Gemini 3.1 Pro

GPT-5.5 Claude Opus 4.7 Gemini 3.1 Pro
Terminal-Bench 2.0
82.7% ← vencedor
69.4%
68.5%
OSWorld (operação de PC)
78.7% ← vencedor
78.0%
Gemini: sem dados
SWE-Bench Pro
58.6%
64.3% ← vencedor
Gemini: sem dados
FrontierMath Tier 4
35.4% ← vencedor
22.9%
16.7%
Tau2-bench Telecom
98.0% ← vencedor
Claude / Gemini: sem comparação direta

Fonte: anúncio oficial da OpenAI (23 de abril de 2026)

BenchmarkGPT-5.5Claude Opus 4.7Gemini 3.1 ProVencedor
Terminal-Bench 2.082.7%69.4%68.5%🥇 GPT-5.5
GDPval (trabalho de conhecimento em 44 ocupações)84.9%🥇 GPT-5.5
OSWorld-Verified (automação de PC)78.7%78.0%🥇 GPT-5.5 (por pouco)
BrowseComp84.4% (Pro: 90.1%)🥇 GPT-5.5 Pro
FrontierMath Tier 435.4% (Pro: 39.6%)22.9%16.7%🥇 GPT-5.5
SWE-Bench Pro58.6%64.3%🥇 Claude Opus 4.7
Tau2-bench Telecom (atendimento ao cliente)98.0%🥇 GPT-5.5
GPQA Diamond93.6%🥇 GPT-5.5
Expert-SWE (interno da OpenAI)73.1%🥇 GPT-5.5

Conclusão: GPT-5.5 detém SOTA em 14 benchmarks, Claude em 4 e Gemini em 2

No conjunto de benchmarks publicado pela OpenAI, o GPT-5.5 detém SOTA em 14 benchmarks, o Claude Opus 4.7 em 4 e o Gemini 3.1 Pro em 2. A vantagem geral pertence claramente ao GPT-5.5.

Dito isso, no SWE-Bench Pro (tarefas de coding em nível de produção), o Claude Opus 4.7 ainda ganha com 64.3% contra os 58.6% do GPT-5.5. Para trabalho de coding, dividir os modelos por tarefa ainda vale a pena.

Verificação por terceiros: avaliação de code review da CodeRabbit

O serviço independente de code review CodeRabbit reporta as seguintes melhorias do GPT-5.5:

  • Benchmark curado: detecção esperada de problemas 58.3% → 79.2%, precisão 27.9% → 40.6%
  • Conjunto de dados do mundo real: detecção de problemas 55.0% → 65.0%, precisão 11.6% → 13.2%

A leitura da CodeRabbit: "o modelo prefere mudanças locais, preserva o comportamento e tende a focar nos pontos reais de falha." Em outras palavras — em vez de reescritas amplas, ele se inclina a correções precisas e direcionadas.

4. GPT-5.5 vs GPT-5.5 Pro — qual usar

ItemGPT-5.5 (padrão)GPT-5.5 Pro
Preço da API (entrada)$5 / 1M tokens$30 / 1M tokens (6x)
Preço da API (saída)$30 / 1M tokens$180 / 1M tokens (6x)
BrowseComp84.4%90.1%
FrontierMath Tier 435.4%39.6%
Planos do ChatGPTPlus / Pro / Business / EnterpriseApenas Pro / Business / Enterprise
Indicado paraTarefas do dia a dia, coding, agentesPesquisa científica, matemática complexa, raciocínio profundo

Como escolher

  • Escolha o GPT-5.5 padrão: coding em geral, escrita, cargas de agentes, uso com foco em custo
  • Escolha o GPT-5.5 Pro: matemática e pesquisa científica, redação de papers, decisão complexa — precisão acima de custo

5. Preços — por que o aumento de 2x

Preço da API (GPT-5.5 padrão)

ItemPreçoNotas
Entrada$5.00 / 1M tokens2x o GPT-5.4
Entrada em cache$0.50 / 1M tokens1/10 da entrada normal
Saída$30.00 / 1M tokens2x o GPT-5.4
Prompts longos (>272K tokens)Entrada 2x, saída 1.5xAplicado a sessão inteira
Batch API / Flex50% de descontoPara cargas assíncronas
Processamento Priority2.5xPara requisitos de baixa latência
Processamento regional (residência de dados)+10%Para casos de compliance

Por que o aumento de 2x?

A OpenAI não explicou diretamente o aumento de preço, mas os fatores prováveis são:

  1. Custo de um re-treinamento completo do modelo base — a primeira reconstrução do zero desde o GPT-4.5
  2. Precificação dos ganhos de desempenho — melhorias significativas em Terminal-Bench e outros
  3. A eficiência em tokens compensa parte da dor — 40% menos tokens de saída equilibra parcialmente o preço unitário maior

Para cargas com saída intensa, o aumento de custo efetivo fica em torno de "2x x 0.6 = 1.2x." Mas para tarefas com entrada intensa (resumo, análise), você leva o aumento total de 2x na cabeça — tenha isso em mente.

6. Disponibilidade nos planos do ChatGPT

PlanoMensalGPT-5.5GPT-5.5 ProCodex
Free$0❌ Não❌ Não❌ Não
Plus$20/mês✅ Sim❌ Não✅ Sim
Pro$200/mês✅ Sim✅ Sim✅ Sim (inclui Fast Mode)
BusinessPor uso✅ Sim✅ Sim✅ Sim
EnterpriseSob consulta✅ Sim✅ Sim✅ Sim

Usuários Free continuam no GPT-5 (ou 5.4)

O GPT-5.5 não está disponível no plano Free — usuários Free continuam no GPT-5 (ou 5.4). O Plus ($20/mês) e o ponto de entrada.

7. Especificações da API e recursos para devs

Recursos suportados

  • ✅ Function calling
  • ✅ Saídas estruturadas (JSON Schema)
  • ✅ Streaming
  • ✅ Controle de esforço de raciocínio (none/low/medium/high/xhigh)
  • ✅ Ferramentas: web search, file search, geração de imagem, Code Interpreter, Hosted Shell, Apply Patch, Skills, Computer Use, MCP, Tool Search
  • ✅ Distillation (para modelos menores)
  • ❌ Fine-tuning: não suportado no lançamento
  • ❌ Áudio / vídeo na entrada ou saída: não suportado

Limites de taxa (Tier 5: o mais alto)

  • RPM (requisições por minuto): 15.000
  • TPM (tokens por minuto): 40.000.000
  • Limite da fila Batch: 15.000.000.000

Exemplo de esforço de raciocínio (Python)

from openai import OpenAI
client = OpenAI()

response = client.responses.create(
    model="gpt-5.5",
    reasoning={"effort": "high"},  # none/low/medium/high/xhigh
    input="Resolva este problema matematico complexo passo a passo..."
)

print(response.output_text)

8. Integração com Codex e a estratégia Super-app

Codex Fast Mode

Junto com o lançamento do GPT-5.5, o Codex ganhou um Fast Mode:

  • Processamento 1.5x mais rápido
  • 2.5x do custo (em créditos)
  • Disponível nos planos Pro / Business / Enterprise

A estratégia Super-app

A OpenAI também revelou uma visão de "Super-app" que une "ChatGPT + Codex + navegador de IA" em uma única oferta. O plano e entregar isso como um pacote enterprise único — o que a OpenAI chama de "um passo em direção a uma computação mais agêntica e mais intuitiva."

Conceitualmente, e o padrão "pacote tudo-em-um para maximizar a experiência do desenvolvedor" de PaaS como a Vercel ou Next.js, trazido para o espaço de agentes de IA.

9. GPT-5.5 vs Claude Opus 4.7 vs Gemini 3.1 Pro

GPT-5.5 vs Claude Opus 4.7 vs Gemini 3.1 Pro

Comparativo dos três últimos modelos de fronteira

GPT-5.5

Lançado em 23 de abril de 2026

Preço (entrada/saída)
$5 / $30 por MTok
Contexto
1.050.000 tokens
Benchmarks SOTA
14
Pontos fortes
◎ Agentes · operação de PC
◎ Matemática · pesquisa científica
◎ Automação de suporte ao cliente
Ponto fraco
△ Tendência a alucinar
Claude Opus 4.7

Lançado em 16 de abril de 2026

Preço (entrada/saída)
$5 / $25 por MTok
Contexto
200K padrão / 1M estendido
Benchmarks SOTA
4
Pontos fortes
◎ SWE-Bench Pro 64.3%
◎ Codificação autônoma de longa duração
◎ Segurança · precisão
Ponto fraco
△ Inferior em capacidade agêntica global
Gemini 3.1 Pro

Lançado no início de 2026

Preço (entrada/saída)
Não divulgado (por nível)
Contexto
1.000.000 tokens
Benchmarks SOTA
2
Pontos fortes
◎ Multimodal em todos os modos
◎ Integração com Google Workspace
◎ Compreensão de vídeo
Ponto fraco
△ Codificação um pouco mais fraca
ItemGPT-5.5Claude Opus 4.7Gemini 3.1 Pro
Lançado23 de abril de 202616 de abril de 2026Início de 2026
Entrada da API$5/MTok$5/MTokNão divulgado
Saída da API$30/MTok$25/MTokNão divulgado
Contexto1.050K1.000K (200K padrão)1.000K
Corte de conhecimento1 dez 2025~início de 2025~início de 2025
Benchmarks SOTA1442
Terminal-Bench 2.082.7%69.4%68.5%
SWE-Bench Pro58.6%64.3%
FrontierMath T435.4%22.9%16.7%
Pontos fortesAgentes, tarefas longas, operação de PCSessões longas de coding, segurança, escrita longaMultimodal, integração com Google Workspace

Como escolher

  • Melhor no geral + desempenho de agente de ponta — GPT-5.5 (especialmente se >$30/MTok de saída for aceitável)
  • Coding autônomo longo e trabalho com segurança em primeiro lugar — Claude Opus 4.7 (vence no SWE-Bench Pro e tem preço de saída mais barato)
  • Integração com Google Workspace e multimodal — Gemini 3.1 Pro

10. Pontos de atenção — cuidado com o excesso de confiança

Análise independente (Handy AI) sinaliza uma tendência no GPT-5.5 de "responder com confiança sobre coisas que ele não sabe de fato."

"O modelo sabe mais, mas também responde com mais confiança sobre coisas que não sabe."

Casos de uso de alto risco

  • ⚠️ Diagnóstico médico ou prescricoes — informação errada pode ser fatal
  • ⚠️ Aconselhamento jurídico ou pesquisa de jurisprudência — citar casos alucinados e questão de ética profissional
  • ⚠️ Aconselhamento financeiro ou trabalho fiscal — exposição regulatória
  • ⚠️ Citações em escrita acadêmica — casos conhecidos de citar papers inexistentes

Mitigações

  1. Fact-checking obrigatório — nunca use a saída da IA como está; verifique contra fontes primárias
  2. Use a ferramenta de web search — faça o modelo buscar informações em tempo real
  3. Verifique cruzando com Claude Opus 4.7 — para trabalho crítico em precisão, passe as respostas por vários modelos
  4. Diga para ele responder "não sei" — instrua via system prompt: "se incerto, diga isso explicitamente"

11. Quando escolher GPT-5.5 — por caso de uso

✅ Escolha o GPT-5.5 quando

  • Agentes autônomos de coding em execução prolongada — Expert-SWE 73.1% e o melhor da classe
  • Automação de PC / Computer Use — OSWorld 78.7% está a par do Opus 4.7
  • Automação de atendimento ao cliente — Tau2-bench 98.0% e essencialmente perfeito
  • Matemática avançada e pesquisa científica — FrontierMath T4 35.4% (bem acima dos 22.9% do Opus 4.7)
  • Você está comprometido com o ecossistema OpenAI — integra com ChatGPT, Codex, Operator

❌ Pule o GPT-5.5 quando

  • Coding de produção em nível SWE-Bench Pro — Claude Opus 4.7 ainda lidera
  • Trabalho crítico em precisão (médico, jurídico, financeiro) — cuidado com alucinações
  • Custo e a prioridade máxima — $30/MTok de saída está no topo da faixa
  • Você quer uma opção gratuita — não está disponível no plano Free
  • Processamento de áudio ou vídeo — apenas entrada de texto + imagem

FAQ

Q1. Quando o GPT-5.5 ficou disponível no ChatGPT?

23 de abril de 2026 (horário dos EUA), nos planos Plus, Pro, Business e Enterprise. O GPT-5.5 Pro esta restrito a Pro, Business e Enterprise.

Q2. Posso usar o GPT-5.5 no plano Free?

Não. O plano Free continua no GPT-5 (ou 5.4). Para acessar o GPT-5.5 você precisa de pelo menos o plano Plus de $20/mês.

Q3. GPT-5.5 vs Claude Opus 4.7 — qual é melhor?

No geral, o GPT-5.5 (SOTA em 14 benchmarks contra os 4 do Claude). Mas no SWE-Bench Pro, o Claude Opus 4.7 vence por 64.3% a 58.6% — então para coding de produção, o Claude leva vantagem. O Claude também é mais barato na saída ($25/MTok vs $30/MTok do GPT-5.5).

Q4. A API ficou mais cara — como manter os custos sob controle?

Sim, $5/$30 por MTok e 2x o GPT-5.4. Mas o uso de tokens de saída cai cerca de 40%, então para cargas com saída intensa o aumento real de custo costuma ficar em torno de 1.2x. Dicas de controle de custo:
1. Use Batch API / Flex (50% de desconto)
2. Use entrada em cache ($0.50/MTok, 1/10 do normal)
3. Use reasoning.effort=low para tarefas mais leves
4. Evite prompts acima de 272K tokens

Q5. O que muda de fato no GPT-5.5 Pro?

Tem raciocínio mais forte, com saltos notáveis em matemática complexa (FrontierMath: 35.4% → 39.6%) e tarefas de pesquisa científica. O porém é o preço — 6x a tarifa da API ($30 entrada / $180 saída). Fora de pesquisa e escrita seria de papers, o custo-benefício frequentemente não fecha.

Q6. Fine-tuning é suportado?

Não, em abril de 2026. Distillation (treinar modelos menores a partir das saídas) e suportado, então você pode usar saídas do GPT-5.5 para treinar algo como o GPT-5 nano.

Q7. Algo a se observar ao usar o contexto de 1M?

Prompts acima de 272K tokens disparam uma sobretaxa de 2x na entrada e 1.5x na saída em toda a sessão. Se você está projetando uma API em torno do uso de 1M tokens, calcule os custos antes.

Q8. Qual é o corte de conhecimento do GPT-5.5?

1 de dezembro de 2025. Qualquer coisa depois disso (a partir de janeiro de 2026) não está nos dados de treinamento, então a ferramenta de web search é praticamente obrigatória para informações atuais.

Q9. As alucinações melhoraram?

Análises independentes dizem que "a base de conhecimento cresceu, mas a confiança do modelo sobre coisas que ele não sabe também cresceu." A OpenAI alega melhorias de segurança oficialmente, mas para trabalho médico, jurídico ou financeiro, fact-checking continua obrigatório.

Q10. Meu app GPT-5 existente vai funcionar do mesmo jeito?

A compatibilidade da API e preservada — trocar o ID do modelo de gpt-5 para gpt-5.5 já basta para migrar. Dito isso, aproveitar os novos recursos (como o parâmetro reasoning.effort, ou especificar o ID da variante Pro) merece uma revisão de design.

Encerrando: o GPT-5.5 e o mais forte, mas não o melhor universal

O GPT-5.5 detém SOTA em 14 benchmarks e abre vantagem clara sobre Claude Opus 4.7 e Gemini 3.1 Pro para retomar o topo da indústria. É especialmente forte em tarefas de agente, automação de PC, coding autônomo de longa duração e matemática e pesquisa científica.

Ao mesmo tempo, ainda perde para o Claude Opus 4.7 no SWE-Bench Pro, mostra uma tendência de "alucinação confiante" e vem com uma alta de 2x no preço da API — então não é uma vitória incondicional.

A jogada mais inteligente e "escolher o certo — GPT-5.5, Claude Opus 4.7 ou Gemini 3.1 Pro — para a tarefa em mãos." Tudo no ecossistema OpenAI? GPT-5.5. Sessões longas de coding e trabalho com segurança em primeiro lugar? Claude. Integração com Google Workspace? Gemini. Operações multi-modelo estão se tornando o padrão de 2026.

Artigos relacionados