Atualização de 29 de setembro de 2026: a OpenAI lançou o sucessor, o GPT-6 Astra, em 3 de setembro de 2026, e os GPT-6 Sol e GPT-6 Luna em 22 de setembro (horário dos EUA). Este artigo compara a geração anterior: GPT-5.6 e GPT-5.5. Quando chama o Sol de "carro-chefe" ou "topo de linha", refere-se à geração GPT-5.6. Se você está escolhendo hoje para onde migrar a partir do GPT-5.5, comece pelo Astra, pelo Sol e pelo Luna da geração GPT-6: em 30 de setembro de 2026, a lista de modelos da API recomenda o Astra para quem não sabe por onde começar, o GPT-6.1 Sol (lançado em 29 de setembro; no ChatGPT está disponível no Work e no Codex, não no chat) para equilibrar inteligência e custo e o GPT-6 Luna para cargas de alto volume em que o custo pesa mais. O GPT-5.5 será aposentado do ChatGPT, do ChatGPT Work e do Codex em 14 de outubro de 2026 (a API da OpenAI não é afetada), e a OpenAI indica como substituto o GPT-6 Sol nos planos pagos e o GPT-6 Luna no aplicativo para desktop nos planos Free e Go (o GPT-5.6 Sol, o Terra e o Luna continuam disponíveis durante o período de transição). Para o custo, veja nossa comparação medida entre o Astra em low e o GPT-5.6 Sol em high.
Índice
- 1. O que mudou — de um único carro-chefe para 3 modelos
- 2. Tabela rápida de especificações
- 3. O impacto do Terra — "qualidade tipo 5.5 por 40% do preço"
- 4. Benchmarks — quanto evoluiu de uma geração para outra
- 5. Novos recursos adicionados no 5.6
- 6. Custo real — como a fatura muda com o upgrade
- 7. Vale a pena migrar? — para qual modelo mudar
- Conclusão
- FAQ
A partir do GPT-5.5, lançado em 23 de abril de 2026, apenas dois meses e meio depois, no dia 9 de julho, a OpenAI disponibilizou de forma geral o GPT-5.6. Mas esta atualização não é "apenas um ganho de desempenho". A maior mudança é a reestruturação de "um único modelo carro-chefe" para "um esquema de 3 modelos: Luna / Terra / Sol".
E, para muitos usuários do GPT-5.5, o que mais pesa é o fato de que o modelo intermediário Terra oferece "qualidade equivalente à do GPT-5.5, por muito menos". No lançamento era metade do preço e, com o corte de 30 de julho de 2026, passou a 40% do preço unitário do GPT-5.5. Para quem quer mais desempenho, há o topo de linha Sol (reforçado, pelo mesmo preço do GPT-5.5); para quem quer reduzir custos, há o Terra — surgiu essa escolha. Neste artigo, organizamos, com base em anúncios oficiais e análises independentes, o que mudou do GPT-5.5 para o 5.6 e para qual modelo você deve migrar.
De um carro-chefe para um esquema de 3 modelos
— poder escolher entre "aumentar o desempenho" ou "reduzir a fatura"
Terra oferece "qualidade tipo 5.5 por 40% do preço" / Sol oferece "mais desempenho pelo mesmo preço"
1. O que mudou — de um único carro-chefe para 3 modelos
O GPT-5.5 tinha uma estrutura de dois níveis: "versão comum ($5/$30) + GPT-5.5 Pro, mais caro ($30/$180)". O GPT-5.6 reformulou isso em 3 modelos escolhidos por finalidade e custo.
Ideal para processamento em massa, classificação e chats leves. Uma nova posição, um nível mais barato que o GPT-5.5.
Qualidade equivalente à do GPT-5.5 por 40% do preço unitário. O sucessor de fato para "quem já se satisfazia com o 5.5".
O carro-chefe da geração GPT-5.6, que eleva o desempenho pelo mesmo preço do GPT-5.5. O sucessor puro em termos de desempenho.
Ou seja, o destino de migração dos usuários do GPT-5.5 varia conforme a finalidade. Se você quer "reduzir o custo com a mesma qualidade", escolha o Terra; se quer "aumentar o desempenho pelo mesmo preço", o Sol; se quer "processar volume ainda mais barato", o Luna. Em comparação com o modelo único do 5.5, a liberdade de escolha aumentou bastante.
2. Tabela rápida de especificações
| Item | GPT-5.5 | GPT-5.6 Sol | GPT-5.6 Terra |
|---|---|---|---|
| Lançamento | 23 de abril de 2026 | 9 de julho de 2026 | |
| Posicionamento | Carro-chefe único (+ Pro) | Topo de linha | Equilíbrio (tipo 5.5 por 40% do preço unitário) |
| Preço da API | $5 / $30 | $5 / $30 | $2 / $12 |
| Contexto | 1,050,000 | 1,050,000 | 1,050,000 |
| Saída máxima | 128,000 | 128,000 | 128,000 |
| Cutoff de conhecimento | 1 de dezembro de 2025 | 16 de fevereiro de 2026 (atualizado) | |
| SWE-Bench Pro | 58.6% | 64.6% | 63.4% |
| Eficiência de inferência | Base | Segundo a OpenAI, entrega resultados iguais ou melhores com menos tokens (não há número publicado da redução em relação ao GPT-5.5) | |
| Controle de raciocínio | effort (none a xhigh) | effort (none a max, com max adicionado) | |
* Preços e especificações baseiam-se nas páginas de modelos da OpenAI (GPT-5.5, GPT-5.6 Sol, GPT-5.6 Terra). O Sol tem preço promocional de $4/$20 por 3 meses a partir de 21 de agosto de 2026. No SWE-Bench Pro, os 58.6% do GPT-5.5 são o valor da OpenAI no lançamento do GPT-5.5 (abril de 2026), e os 64.6% do Sol vêm da tabela de avaliação que a OpenAI publicou com o GPT-5.6 (na mesma tabela, o GPT-5.5 aparece com 59.4%). No TerminalBench, os 82.7% do GPT-5.5 no lançamento são da versão 2.0; a tabela do GPT-5.6 também mede o GPT-5.5 na 2.1: 85.6% contra 88.8% do Sol (ver capítulo 4).
3. O impacto do Terra — "qualidade tipo 5.5 por 40% do preço"
O maior impacto desta atualização não é o ganho de desempenho do topo de linha Sol, mas sim a relação preço/desempenho do intermediário Terra. A OpenAI posiciona o Terra como "oferecer qualidade equivalente à do GPT-5.5 por cerca de metade do preço" (OpenAI).
Mesma qualidade, fatura 60% menor
Terra: $2.00
→ 60% mais barato
Terra: $12.00
→ 60% mais barato
→ sem número de redução publicado; se valer, o custo efetivo cai mais um nível
* A OpenAI afirma que treinou o GPT-5.6 para "tirar mais trabalho útil de cada token", mas não publicou um número de redução em relação ao GPT-5.5. No lançamento, o preço unitário era metade do GPT-5.5 e, com o corte de 30 de julho de 2026, passou a 40% dele.
O Terra é, por assim dizer, o modelo para usuários que "se satisfaziam com o GPT-5.5, mas querem apenas reduzir a fatura". Se dá para cortar 60% do custo sem perder qualidade, ele se torna o primeiro destino de migração para muitas cargas de trabalho existentes. A maioria das tarefas práticas que não perseguem desempenho máximo se resolve com o Terra, e não com o Sol.
4. Benchmarks — quanto evoluiu de uma geração para outra
Ao avaliar o ganho entre gerações, é preciso ter cuidado: o que teve a versão do benchmark alterada não pode ser comparado diretamente. Aqui separamos "o que dá para comparar na mesma versão" e "o que não dá".
A codificação real subiu +6pt entre gerações
Capacidade de corrigir issues reais do GitHub. Alta de cerca de 6 pontos entre gerações (fonte: OpenAI)
No mesmo indicador SWE-Bench Pro, houve alta de cerca de 6 pontos, dos 58.6% do GPT-5.5 para os 64.6% do Sol. É um ganho consistente na capacidade de correção em codificação de nível de produção real. Vale notar, porém, que os dois valores vêm de anúncios diferentes da OpenAI: na tabela de avaliação publicada com o GPT-5.6, o GPT-5.5 aparece com 59.4% (diferença de cerca de 5 pontos).
⚠️ Cuidados ao comparar
- TerminalBench: os 82.7% do GPT-5.5 no lançamento são da versão 2.0, e os 88.8% do GPT-5.6 Sol, da 2.1, então não dá para subtrair diretamente. Na tabela de avaliação do GPT-5.6, que mede os dois na 2.1, o GPT-5.5 marca 85.6% (diferença de cerca de 3 pontos).
- GPQA, FrontierMath: estão na tabela de avaliação do GPT-5.6. No GPQA Diamond, o Sol marca 94.6% contra 93.6% do GPT-5.5; no FrontierMath Tier 1–3, 89% contra 85.3%. Estão perto do teto, então o ganho é pequeno. AIME e MMLU não aparecem.
Desta vez, a OpenAI pôs em primeiro plano novos indicadores da linha de agentes (Agents' Last Exam 53.6, Coding Agent Index 80 etc.). No raciocínio geral, o GPQA Diamond varia só 1 ponto perto do teto; na prática, é difícil medir "quanto mais inteligente ficou entre gerações" usando os benchmarks tradicionais.
5. Novos recursos adicionados no 5.6
- Esquema de 3 modelos (Luna/Terra/Sol) — escolha por finalidade e custo. A maior mudança.
- Programmatic Tool Calling — novo recurso em que o modelo gera JavaScript e orquestra as chamadas de ferramentas (Responses API). Executa agentes complexos com menos idas e voltas.
- Adição do "max" ao effort de raciocínio — agora com 6 níveis: none/low/medium/high/xhigh mais o max.
- ChatGPT Work — agente voltado para o trabalho. O aplicativo do Codex foi integrado ao novo aplicativo desktop do ChatGPT.
- GPT-Live (voz full-duplex) — conversa por voz natural, interrompível, sem alternância de turnos.
- Suporte ao GitHub Copilot — Sol/Terra/Luna passam a poder ser selecionados no Copilot.
- Atualização do cutoff de conhecimento — de dezembro de 2025 para 16 de fevereiro de 2026.
6. Custo real — como a fatura muda com o upgrade
O impacto da migração para o Terra sobre o custo é grande. Comparando, por hipótese, uma carga de trabalho de 100M tokens de entrada e 20M tokens de saída por mês:
entrada 100M×$5 + saída 20M×$30
entrada 100M×$2 + saída 20M×$12. Se a eficiência de tokens melhorar, pode cair ainda mais
Só pelo preço unitário, a fatura cai cerca de 60%. Além disso, a OpenAI afirma que o GPT-5.6 conclui o trabalho com menos tokens; se for o caso, a redução real pode ser maior do que a diferença de preço unitário (não há número de redução publicado). Para cargas de trabalho em que a qualidade do GPT-5.5 basta, a migração para o Terra é praticamente uma economia pura de custo.
* Os valores acima são estimativas baseadas no preço unitário. A fatura real varia conforme o comprimento do prompt, o uso de cache e o volume de saída. Recomendamos medir com suas próprias requisições representativas.
7. Vale a pena migrar? — para qual modelo mudar
| Seu uso atual do GPT-5.5 | Destino recomendado | Motivo |
|---|---|---|
| Qualidade já basta, quer reduzir o custo | Terra | Qualidade tipo 5.5 por 40% do preço unitário. Economia pura |
| Quer mais desempenho com o mesmo orçamento | Sol | Mesmo preço $5/$30, com melhora em SWE-Bench Pro etc. |
| Processamento em massa e tarefas leves, o mais barato possível | Luna | Novo nível mais barato, a $0.20/$1.20 |
| Usava o GPT-5.5 Pro ($30/$180) | Sol | Muito mais barato que o Pro e, em geral, suficiente para o alto raciocínio do dia a dia |
| Qualidade da correção de código é prioridade máxima | Sol + comparação externa | Em codificação real, os modelos da Claude também são candidatos |
A migração em si se resume a trocar o ID do modelo, e a API é praticamente compatível. A melhor solução para muitos usuários é uma abordagem em dois estágios: "primeiro, baixar para o Terra e cortar 60% da fatura e, só para os processos que exigem desempenho, subir para o Sol". Ficou mais fácil ajustar custo e qualidade do que na era do modelo único do 5.5.
Conclusão
- A maior mudança é a divisão em 3 modelos: do carro-chefe único do GPT-5.5 para 3 modelos por finalidade — Luna/Terra/Sol.
- O Terra é o protagonista: qualidade equivalente à do GPT-5.5 por 40% do preço unitário ($2/$12). O sucessor de fato das cargas de trabalho existentes.
- O Sol melhora o desempenho pelo mesmo preço: mantendo $5/$30, o SWE-Bench Pro vai de 58.6 para 64.6% (valores da OpenAI, +6pt).
- A eficiência também melhorou: segundo a OpenAI, entrega resultados iguais ou melhores com menos tokens (sem número de redução publicado em relação ao GPT-5.5).
- Atenção: a versão do TerminalBench muda entre os anúncios (na mesma 2.1, o GPT-5.5 marca 85.6% e o Sol 88.8%). O ganho em raciocínio geral, como GPQA, é pequeno.
- A melhor solução de migração: primeiro corte 60% da fatura com o Terra e suba para o Sol só nos processos que exigem desempenho.
FAQ
Q1. Se eu for migrar do GPT-5.5, qual modelo escolher?
Depende do uso. Se quer reduzir o custo mantendo a qualidade, o Terra (tipo 5.5 por 40% do preço unitário); se quer aumentar o desempenho pelo mesmo preço, o Sol; se quer o mais barato possível para processamento em massa, o Luna. A maioria das tarefas práticas se resolve com o Terra, e a melhor abordagem é em dois estágios: subir para o Sol só nos processos que exigem desempenho.
Q2. O Terra tem mesmo qualidade equivalente à do GPT-5.5?
A OpenAI o posiciona como "qualidade equivalente à do GPT-5.5 por cerca de metade do preço". Na tabela de avaliação do GPT-5.6, o Terra supera o GPT-5.5 no SWE-Bench Pro (63.4% contra 59.4%), mas fica ligeiramente abaixo em alguns itens, como o GPQA Diamond (92.9% contra 93.6%). Pelo posicionamento, é o "sucessor dos usos em que o 5.5 bastava". Se tiver receio, o mais seguro é comparar na prática as saídas do Terra e do 5.5 nas suas tarefas representativas antes de migrar.
Q3. Quanto mais inteligente ficou entre gerações?
No mesmo indicador SWE-Bench Pro, houve alta de cerca de 6 pontos, de 58.6% para 64.6% (Sol; ambos valores da OpenAI). O TerminalBench mudou da versão 2.0 para a 2.1 entre os anúncios, mas na tabela que mede os dois na 2.1 o GPT-5.5 marca 85.6% e o Sol 88.8%. O GPQA Diamond vai de 93.6% para 94.6%, perto do teto, então o ganho é pequeno. Na prática, "o que subiu de forma clara foi a codificação real e o trabalho de agentes; o raciocínio geral ficou quase estável".
Q4. Na prática, quanto o custo cai?
Migrando para o Terra, o preço unitário fica em cerca de 40% do GPT-5.5. Com 100M de entrada e 20M de saída por mês, a estimativa vai de $1,100 para $440 (após o corte de preços de 30 de julho de 2026). A OpenAI também afirma que o GPT-5.6 conclui o trabalho com menos tokens; se for o caso, a redução real pode ser maior do que a diferença de preço unitário (não há número de redução publicado).
Q5. Eu usava o GPT-5.5 Pro. Qual é o sucessor?
Para muitos usos, o Sol ($5/$30, com preço promocional de três meses a $4/$20 a partir de 21 de agosto de 2026) basta. O GPT-5.5 Pro era caro, a $30/$180, mas o Sol dá conta de alto raciocínio por muito menos. Vale avaliar nas suas tarefas reais se apenas o raciocínio ultra difícil ainda exige algo equivalente ao Pro.
Q6. Meus aplicativos existentes com GPT-5.5 continuam funcionando?
A API é praticamente compatível, e dá para migrar apenas trocando o ID do modelo. Mas, como agora há 3 modelos, redesenhar quais processos atribuir a Luna/Terra/Sol permite otimizar custo e qualidade. Em muitos casos, partir do Terra é eficaz.
Q7. Em que o GPT-5.6 difere de modelos de outras empresas (Claude)?
Em codificação real (SWE-Bench Pro), os modelos da Claude tendem a se sair melhor (mesmo na tabela de avaliação da OpenAI, o Claude Fable 5 marca 80% contra 64.6% do Sol). Para mais detalhes, consulte as comparações GPT-5.6 Sol vs Claude Opus 4.8 e vs Claude Fable 5.
Artigos relacionados
- GPT-5.6: guia completo do lançamento — detalhes dos 3 modelos Luna/Terra/Sol
- GPT-5.5: guia completo do lançamento — detalhes do modelo da geração anterior
- GPT-5.6 Sol vs Claude Opus 4.8: comparação completa — comparação com o carro-chefe de outra empresa na época
- GPT-5.6 Sol vs Claude Fable 5: comparação completa — duelo dos topos de linha