Índice
- 1. Visão geral do lançamento — data, disponibilidade e ficha técnica
- 2. O que há de novo — 5 melhorias principais
- 3. Benchmarks — comparativo direto com Claude e Gemini
- 4. GPT-5.5 vs GPT-5.5 Pro — qual usar
- 5. Preços — por que o aumento de 2x
- 6. Disponibilidade nos planos do ChatGPT
- 7. Especificações da API e recursos para devs
- 8. Integração com Codex e a estratégia Super-app
- 9. GPT-5.5 vs Claude Opus 4.7 vs Gemini 3.1 Pro
- 10. Pontos de atenção — cuidado com o excesso de confiança
- 11. Quando escolher GPT-5.5 — por caso de uso
- FAQ
Em 23 de abril de 2026, a OpenAI lançou o "ChatGPT 5.5 (GPT-5.5)." Apresentado pela própria OpenAI como "uma nova classe de inteligência para trabalho real e agentes de IA," o modelo marcou 82.7% no Terminal-Bench 2.0, deixando para trás o Claude Opus 4.7 da Anthropic (69.4%) e o Gemini 3.1 Pro do Google (68.5%) e retomando o SOTA (state of the art) em 14 benchmarks no processo.
Ao mesmo tempo, o preço de tabela da API dobrou em relação ao GPT-5.4 ($5/$30 por MTok), e o Claude Opus 4.7 continua superior no SWE-Bench Pro. A leitura honesta e "o mais forte, mas não o melhor universal." Também há uma tendência documentada de responder com confiança sobre coisas que ele não sabe de fato — algo a se ter em mente em trabalho médico, jurídico ou regulado.
Com base no anúncio oficial da OpenAI, na OpenAI Developer Docs e em vários relatórios independentes de benchmark, este artigo entrega o panorama completo: o que há de novo, os benchmarks, preços, disponibilidade nos planos, como se compara com Claude e Gemini e como escolher o modelo certo para o que você está fazendo.
Lançamento do GPT-5.5
Uma nova classe de inteligência para trabalho real e agentes de IA
1. Visão geral do lançamento — data, disponibilidade e ficha técnica
| Item | Detalhes |
|---|---|
| Nome oficial | GPT-5.5 (exibido como "ChatGPT 5.5" no ChatGPT) |
| Data de lançamento | 23 de abril de 2026 |
| Desenvolvido por | OpenAI |
| Variantes | GPT-5.5 (padrão) / GPT-5.5 Pro (raciocínio profundo) |
| Janela de contexto | API: 1.050.000 tokens (~1M) / Codex: 400K tokens |
| Saída máxima | 128.000 tokens |
| Corte de conhecimento | 1 de dezembro de 2025 |
| Preço da API (padrão) | $5 / 1M tokens (entrada) / $0.50 (entrada em cache) / $30 (saída) |
| Preço da API (Pro) | $30 (entrada) / $180 (saída) |
| Sobretaxa de prompt longo | Acima de 272K tokens: entrada 2x, saída 1.5x |
| Modalidades | Texto entrada/saída, imagem na entrada (sem áudio nem vídeo) |
| Planos do ChatGPT | Plus / Pro / Business / Enterprise (não está no Free) |
| Recursos principais | Function calling, saídas estruturadas, streaming, controle de esforço de raciocínio, Computer Use, suporte a MCP |
2. O que há de novo — 5 melhorias principais
1. Re-treinamento completo do modelo base (o primeiro desde o GPT-4.5)
O GPT-5.5 e o primeiro re-treinamento completo do modelo base desde o GPT-4.5. GPT-5, 5.1, 5.2 e 5.4 eram todos variantes ajustadas (fine-tuned) do mesmo modelo base, mas o GPT-5.5 foi reconstruído do zero. O resultado são melhorias na eficiência de raciocínio e atualização de conhecimento ao mesmo tempo.
2. Grandes ganhos de eficiência em tokens (~40% de redução)
O GPT-5.5 mantém a mesma latência por token do GPT-5.4 enquanto reduz os tokens de saída necessários para concluir tarefas no Codex em cerca de 40%. O preço de tabela dobrou, mas como o volume de saída cai 40%, a OpenAI afirma que o custo total para o mesmo trabalho geralmente cresce menos do que se imagina.
Greg Brockman, cofundador da OpenAI:
"É um modelo que pensa mais rápido e mais afiado com menos tokens — esse tipo de modelo, comparado a algo como o 5.4."
3. Janela de contexto ~1M (API)
A versão da API expande para 1.050.000 tokens (~1M). A integração com o Codex e de 400K. ~1M tokens equivalem a aproximadamente 1.400 páginas A4 de texto. Só não esqueça da sobretaxa medida: prompts acima de 272K tokens incorrem em preço 2x na entrada e 1.5x na saída, então cargas de trabalho com contexto muito longo precisam de modelagem de custo.
4. Controle de esforço de raciocínio em cinco níveis
A API expõe reasoning.effort com cinco configurações:
- none: sem raciocínio (mais rápido, mais barato)
- low: raciocínio leve
- medium: padrão (equilibrado)
- high: raciocínio profundo (tarefas complexas)
- xhigh: raciocínio máximo (mais lento e mais caro, maior precisão)
Isso espelha o controle output_config.effort do Claude Opus 4.7, e a indústria como um todo esta convergindo para "deixe o chamador ajustar a profundidade de raciocínio."
5. Expert-SWE em 73.1% — lida com tarefas da classe de 20 horas
Na nova avaliação interna publicada pela OpenAI Expert-SWE (tarefas de coding extremamente complexas com tempo mediano de 20 horas para um humano concluir), o GPT-5.5 alcançou 73.1% — um salto de 5.6 pontos sobre os 68.5% do GPT-5.4. E um avanço grande para a confiabilidade de agentes autônomos de coding em execução prolongada.
3. Benchmarks — comparativo direto com Claude e Gemini
Comparativo de benchmarks GPT-5.5 (Top 5)
vs Claude Opus 4.7 / Gemini 3.1 Pro
Fonte: anúncio oficial da OpenAI (23 de abril de 2026)
| Benchmark | GPT-5.5 | Claude Opus 4.7 | Gemini 3.1 Pro | Vencedor |
|---|---|---|---|---|
| Terminal-Bench 2.0 | 82.7% | 69.4% | 68.5% | 🥇 GPT-5.5 |
| GDPval (trabalho de conhecimento em 44 ocupações) | 84.9% | — | — | 🥇 GPT-5.5 |
| OSWorld-Verified (automação de PC) | 78.7% | 78.0% | — | 🥇 GPT-5.5 (por pouco) |
| BrowseComp | 84.4% (Pro: 90.1%) | — | — | 🥇 GPT-5.5 Pro |
| FrontierMath Tier 4 | 35.4% (Pro: 39.6%) | 22.9% | 16.7% | 🥇 GPT-5.5 |
| SWE-Bench Pro | 58.6% | 64.3% | — | 🥇 Claude Opus 4.7 |
| Tau2-bench Telecom (atendimento ao cliente) | 98.0% | — | — | 🥇 GPT-5.5 |
| GPQA Diamond | 93.6% | — | — | 🥇 GPT-5.5 |
| Expert-SWE (interno da OpenAI) | 73.1% | — | — | 🥇 GPT-5.5 |
Conclusão: GPT-5.5 detém SOTA em 14 benchmarks, Claude em 4 e Gemini em 2
No conjunto de benchmarks publicado pela OpenAI, o GPT-5.5 detém SOTA em 14 benchmarks, o Claude Opus 4.7 em 4 e o Gemini 3.1 Pro em 2. A vantagem geral pertence claramente ao GPT-5.5.
Dito isso, no SWE-Bench Pro (tarefas de coding em nível de produção), o Claude Opus 4.7 ainda ganha com 64.3% contra os 58.6% do GPT-5.5. Para trabalho de coding, dividir os modelos por tarefa ainda vale a pena.
Verificação por terceiros: avaliação de code review da CodeRabbit
O serviço independente de code review CodeRabbit reporta as seguintes melhorias do GPT-5.5:
- Benchmark curado: detecção esperada de problemas 58.3% → 79.2%, precisão 27.9% → 40.6%
- Conjunto de dados do mundo real: detecção de problemas 55.0% → 65.0%, precisão 11.6% → 13.2%
A leitura da CodeRabbit: "o modelo prefere mudanças locais, preserva o comportamento e tende a focar nos pontos reais de falha." Em outras palavras — em vez de reescritas amplas, ele se inclina a correções precisas e direcionadas.
4. GPT-5.5 vs GPT-5.5 Pro — qual usar
| Item | GPT-5.5 (padrão) | GPT-5.5 Pro |
|---|---|---|
| Preço da API (entrada) | $5 / 1M tokens | $30 / 1M tokens (6x) |
| Preço da API (saída) | $30 / 1M tokens | $180 / 1M tokens (6x) |
| BrowseComp | 84.4% | 90.1% |
| FrontierMath Tier 4 | 35.4% | 39.6% |
| Planos do ChatGPT | Plus / Pro / Business / Enterprise | Apenas Pro / Business / Enterprise |
| Indicado para | Tarefas do dia a dia, coding, agentes | Pesquisa científica, matemática complexa, raciocínio profundo |
Como escolher
- Escolha o GPT-5.5 padrão: coding em geral, escrita, cargas de agentes, uso com foco em custo
- Escolha o GPT-5.5 Pro: matemática e pesquisa científica, redação de papers, decisão complexa — precisão acima de custo
5. Preços — por que o aumento de 2x
Preço da API (GPT-5.5 padrão)
| Item | Preço | Notas |
|---|---|---|
| Entrada | $5.00 / 1M tokens | 2x o GPT-5.4 |
| Entrada em cache | $0.50 / 1M tokens | 1/10 da entrada normal |
| Saída | $30.00 / 1M tokens | 2x o GPT-5.4 |
| Prompts longos (>272K tokens) | Entrada 2x, saída 1.5x | Aplicado a sessão inteira |
| Batch API / Flex | 50% de desconto | Para cargas assíncronas |
| Processamento Priority | 2.5x | Para requisitos de baixa latência |
| Processamento regional (residência de dados) | +10% | Para casos de compliance |
Por que o aumento de 2x?
A OpenAI não explicou diretamente o aumento de preço, mas os fatores prováveis são:
- Custo de um re-treinamento completo do modelo base — a primeira reconstrução do zero desde o GPT-4.5
- Precificação dos ganhos de desempenho — melhorias significativas em Terminal-Bench e outros
- A eficiência em tokens compensa parte da dor — 40% menos tokens de saída equilibra parcialmente o preço unitário maior
Para cargas com saída intensa, o aumento de custo efetivo fica em torno de "2x x 0.6 = 1.2x." Mas para tarefas com entrada intensa (resumo, análise), você leva o aumento total de 2x na cabeça — tenha isso em mente.
6. Disponibilidade nos planos do ChatGPT
| Plano | Mensal | GPT-5.5 | GPT-5.5 Pro | Codex |
|---|---|---|---|---|
| Free | $0 | ❌ Não | ❌ Não | ❌ Não |
| Plus | $20/mês | ✅ Sim | ❌ Não | ✅ Sim |
| Pro | $200/mês | ✅ Sim | ✅ Sim | ✅ Sim (inclui Fast Mode) |
| Business | Por uso | ✅ Sim | ✅ Sim | ✅ Sim |
| Enterprise | Sob consulta | ✅ Sim | ✅ Sim | ✅ Sim |
Usuários Free continuam no GPT-5 (ou 5.4)
O GPT-5.5 não está disponível no plano Free — usuários Free continuam no GPT-5 (ou 5.4). O Plus ($20/mês) e o ponto de entrada.
7. Especificações da API e recursos para devs
Recursos suportados
- ✅ Function calling
- ✅ Saídas estruturadas (JSON Schema)
- ✅ Streaming
- ✅ Controle de esforço de raciocínio (none/low/medium/high/xhigh)
- ✅ Ferramentas: web search, file search, geração de imagem, Code Interpreter, Hosted Shell, Apply Patch, Skills, Computer Use, MCP, Tool Search
- ✅ Distillation (para modelos menores)
- ❌ Fine-tuning: não suportado no lançamento
- ❌ Áudio / vídeo na entrada ou saída: não suportado
Limites de taxa (Tier 5: o mais alto)
- RPM (requisições por minuto): 15.000
- TPM (tokens por minuto): 40.000.000
- Limite da fila Batch: 15.000.000.000
Exemplo de esforço de raciocínio (Python)
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.5",
reasoning={"effort": "high"}, # none/low/medium/high/xhigh
input="Resolva este problema matematico complexo passo a passo..."
)
print(response.output_text)
8. Integração com Codex e a estratégia Super-app
Codex Fast Mode
Junto com o lançamento do GPT-5.5, o Codex ganhou um Fast Mode:
- Processamento 1.5x mais rápido
- 2.5x do custo (em créditos)
- Disponível nos planos Pro / Business / Enterprise
A estratégia Super-app
A OpenAI também revelou uma visão de "Super-app" que une "ChatGPT + Codex + navegador de IA" em uma única oferta. O plano e entregar isso como um pacote enterprise único — o que a OpenAI chama de "um passo em direção a uma computação mais agêntica e mais intuitiva."
Conceitualmente, e o padrão "pacote tudo-em-um para maximizar a experiência do desenvolvedor" de PaaS como a Vercel ou Next.js, trazido para o espaço de agentes de IA.
9. GPT-5.5 vs Claude Opus 4.7 vs Gemini 3.1 Pro
GPT-5.5 vs Claude Opus 4.7 vs Gemini 3.1 Pro
Comparativo dos três últimos modelos de fronteira
| Item | GPT-5.5 | Claude Opus 4.7 | Gemini 3.1 Pro |
|---|---|---|---|
| Lançado | 23 de abril de 2026 | 16 de abril de 2026 | Início de 2026 |
| Entrada da API | $5/MTok | $5/MTok | Não divulgado |
| Saída da API | $30/MTok | $25/MTok | Não divulgado |
| Contexto | 1.050K | 1.000K (200K padrão) | 1.000K |
| Corte de conhecimento | 1 dez 2025 | ~início de 2025 | ~início de 2025 |
| Benchmarks SOTA | 14 | 4 | 2 |
| Terminal-Bench 2.0 | 82.7% | 69.4% | 68.5% |
| SWE-Bench Pro | 58.6% | 64.3% | — |
| FrontierMath T4 | 35.4% | 22.9% | 16.7% |
| Pontos fortes | Agentes, tarefas longas, operação de PC | Sessões longas de coding, segurança, escrita longa | Multimodal, integração com Google Workspace |
Como escolher
- Melhor no geral + desempenho de agente de ponta — GPT-5.5 (especialmente se >$30/MTok de saída for aceitável)
- Coding autônomo longo e trabalho com segurança em primeiro lugar — Claude Opus 4.7 (vence no SWE-Bench Pro e tem preço de saída mais barato)
- Integração com Google Workspace e multimodal — Gemini 3.1 Pro
10. Pontos de atenção — cuidado com o excesso de confiança
Análise independente (Handy AI) sinaliza uma tendência no GPT-5.5 de "responder com confiança sobre coisas que ele não sabe de fato."
"O modelo sabe mais, mas também responde com mais confiança sobre coisas que não sabe."
Casos de uso de alto risco
- ⚠️ Diagnóstico médico ou prescricoes — informação errada pode ser fatal
- ⚠️ Aconselhamento jurídico ou pesquisa de jurisprudência — citar casos alucinados e questão de ética profissional
- ⚠️ Aconselhamento financeiro ou trabalho fiscal — exposição regulatória
- ⚠️ Citações em escrita acadêmica — casos conhecidos de citar papers inexistentes
Mitigações
- Fact-checking obrigatório — nunca use a saída da IA como está; verifique contra fontes primárias
- Use a ferramenta de web search — faça o modelo buscar informações em tempo real
- Verifique cruzando com Claude Opus 4.7 — para trabalho crítico em precisão, passe as respostas por vários modelos
- Diga para ele responder "não sei" — instrua via system prompt: "se incerto, diga isso explicitamente"
11. Quando escolher GPT-5.5 — por caso de uso
✅ Escolha o GPT-5.5 quando
- Agentes autônomos de coding em execução prolongada — Expert-SWE 73.1% e o melhor da classe
- Automação de PC / Computer Use — OSWorld 78.7% está a par do Opus 4.7
- Automação de atendimento ao cliente — Tau2-bench 98.0% e essencialmente perfeito
- Matemática avançada e pesquisa científica — FrontierMath T4 35.4% (bem acima dos 22.9% do Opus 4.7)
- Você está comprometido com o ecossistema OpenAI — integra com ChatGPT, Codex, Operator
❌ Pule o GPT-5.5 quando
- Coding de produção em nível SWE-Bench Pro — Claude Opus 4.7 ainda lidera
- Trabalho crítico em precisão (médico, jurídico, financeiro) — cuidado com alucinações
- Custo e a prioridade máxima — $30/MTok de saída está no topo da faixa
- Você quer uma opção gratuita — não está disponível no plano Free
- Processamento de áudio ou vídeo — apenas entrada de texto + imagem
FAQ
Q1. Quando o GPT-5.5 ficou disponível no ChatGPT?
23 de abril de 2026 (horário dos EUA), nos planos Plus, Pro, Business e Enterprise. O GPT-5.5 Pro esta restrito a Pro, Business e Enterprise.
Q2. Posso usar o GPT-5.5 no plano Free?
Não. O plano Free continua no GPT-5 (ou 5.4). Para acessar o GPT-5.5 você precisa de pelo menos o plano Plus de $20/mês.
Q3. GPT-5.5 vs Claude Opus 4.7 — qual é melhor?
No geral, o GPT-5.5 (SOTA em 14 benchmarks contra os 4 do Claude). Mas no SWE-Bench Pro, o Claude Opus 4.7 vence por 64.3% a 58.6% — então para coding de produção, o Claude leva vantagem. O Claude também é mais barato na saída ($25/MTok vs $30/MTok do GPT-5.5).
Q4. A API ficou mais cara — como manter os custos sob controle?
Sim, $5/$30 por MTok e 2x o GPT-5.4. Mas o uso de tokens de saída cai cerca de 40%, então para cargas com saída intensa o aumento real de custo costuma ficar em torno de 1.2x. Dicas de controle de custo:
1. Use Batch API / Flex (50% de desconto)
2. Use entrada em cache ($0.50/MTok, 1/10 do normal)
3. Use reasoning.effort=low para tarefas mais leves
4. Evite prompts acima de 272K tokens
Q5. O que muda de fato no GPT-5.5 Pro?
Tem raciocínio mais forte, com saltos notáveis em matemática complexa (FrontierMath: 35.4% → 39.6%) e tarefas de pesquisa científica. O porém é o preço — 6x a tarifa da API ($30 entrada / $180 saída). Fora de pesquisa e escrita seria de papers, o custo-benefício frequentemente não fecha.
Q6. Fine-tuning é suportado?
Não, em abril de 2026. Distillation (treinar modelos menores a partir das saídas) e suportado, então você pode usar saídas do GPT-5.5 para treinar algo como o GPT-5 nano.
Q7. Algo a se observar ao usar o contexto de 1M?
Prompts acima de 272K tokens disparam uma sobretaxa de 2x na entrada e 1.5x na saída em toda a sessão. Se você está projetando uma API em torno do uso de 1M tokens, calcule os custos antes.
Q8. Qual é o corte de conhecimento do GPT-5.5?
1 de dezembro de 2025. Qualquer coisa depois disso (a partir de janeiro de 2026) não está nos dados de treinamento, então a ferramenta de web search é praticamente obrigatória para informações atuais.
Q9. As alucinações melhoraram?
Análises independentes dizem que "a base de conhecimento cresceu, mas a confiança do modelo sobre coisas que ele não sabe também cresceu." A OpenAI alega melhorias de segurança oficialmente, mas para trabalho médico, jurídico ou financeiro, fact-checking continua obrigatório.
Q10. Meu app GPT-5 existente vai funcionar do mesmo jeito?
A compatibilidade da API e preservada — trocar o ID do modelo de gpt-5 para gpt-5.5 já basta para migrar. Dito isso, aproveitar os novos recursos (como o parâmetro reasoning.effort, ou especificar o ID da variante Pro) merece uma revisão de design.
Encerrando: o GPT-5.5 e o mais forte, mas não o melhor universal
O GPT-5.5 detém SOTA em 14 benchmarks e abre vantagem clara sobre Claude Opus 4.7 e Gemini 3.1 Pro para retomar o topo da indústria. É especialmente forte em tarefas de agente, automação de PC, coding autônomo de longa duração e matemática e pesquisa científica.
Ao mesmo tempo, ainda perde para o Claude Opus 4.7 no SWE-Bench Pro, mostra uma tendência de "alucinação confiante" e vem com uma alta de 2x no preço da API — então não é uma vitória incondicional.
A jogada mais inteligente e "escolher o certo — GPT-5.5, Claude Opus 4.7 ou Gemini 3.1 Pro — para a tarefa em mãos." Tudo no ecossistema OpenAI? GPT-5.5. Sessões longas de coding e trabalho com segurança em primeiro lugar? Claude. Integração com Google Workspace? Gemini. Operações multi-modelo estão se tornando o padrão de 2026.
Artigos relacionados
- Análise completa do lançamento do Claude Opus 4.7 — todos os detalhes do concorrente direto
- Guia de migração para o Claude Opus 4.7 — saindo do 4.6 para o 4.7
- Comparativo de preços Claude vs ChatGPT — como as estruturas de plano se comparam
- O que é o Next.js? — o framework React que a IA fica recomendando