Um modelo mais novo é mais inteligente, mas mais caro — costuma ser assim que se pensa. Com o GPT-6 Astra e o GPT-5.6 Sol, no entanto, comparar preços unitários não resolve nada, porque o Astra termina o mesmo trabalho com menos tokens.

A resposta curta antes de tudo. Nas medições da Artificial Analysis, empresa independente de benchmarks, rodar o Astra na sua configuração mais fraca, low, custa quase exatamente o que o Sol custa em high para uma tarefa ($0.82 contra $0.81), e ele pontua mais (46 contra 42). Ele gasta um terço dos tokens de saída, e a espera até a resposta começar é quatro vezes menor.

Só que esse “quase exatamente” se apoia em uma premissa com prazo de validade. O Sol está em preço promocional neste momento e, se o anúncio se confirmar, isso termina no fim de novembro de 2026, quando o preço pode voltar a subir. Partindo das medições da Artificial Analysis e das informações oficiais da OpenAI em 18 de setembro de 2026, este artigo organiza custo, tokens e velocidade em cada esforço de raciocínio, como ficam os números depois que a premissa muda e como a diferença se comporta em codificação.

Astra (low) e Sol (high) medidos com a mesma régua

Artificial Analysis Intelligence Index, por tarefa (em 18 de setembro de 2026)

Custo

$0.82 contra $0.81

Empate. O preço unitário é 2.5 vezes maior, e os totais se igualam

Tokens de saída

4,000 contra 13,000

O Astra chega à resposta com cerca de um terço

Espera até a resposta começar

2.7 s contra 11.9 s

Menos tempo deliberando. É isto que você sente

Intelligence Index

46 contra 42

O Astra na configuração mais fraca supera o Sol numa forte

Fonte: Artificial Analysis, “GPT-6 Astra (low) vs GPT-5.6 Sol (high)”. Os custos são calculados com o preço promocional do Sol ($4/$20)

1. A questão: preço unitário 2.5 vezes maior, um terço dos tokens

Se a comparação parar no preço unitário, o Astra é claramente o modelo caro.

ModeloEntrada (por 1M de tokens)Entrada em cacheSaída (por 1M de tokens)
GPT-6 Astra$10.00$1.00$50.00
GPT-5.6 Sol (preço promocional, 3 meses a partir de 21 de agosto de 2026)$4.00$0.40$20.00
GPT-5.6 Sol (preço anterior à promoção)$5.00$0.50$30.00

Fontes: documentação para desenvolvedores da OpenAI, “GPT-6 Astra”, anúncio do corte de preços na comunidade de desenvolvedores da OpenAI (21 de agosto de 2026)

Contra o preço promocional, o preço unitário do Astra é 2.5 vezes maior na entrada e também 2.5 vezes maior na saída. Julgando só por isso, o assunto se encerra num “caro demais para valer a pena”.

O que você paga, porém, é o preço unitário multiplicado pelos tokens efetivamente gastos. Um modelo de raciocínio pensa antes de responder, e esse pensamento também é cobrado como tokens de saída, então um modelo que chega à resposta certa pensando menos pode sair mais barato no total mesmo com preço unitário maior. É essa a questão que este artigo se propõe a responder.

2. Quem foi, afinal, que disse que o low basta?

Tudo começou com uma afirmação: o Astra em low é melhor que o Sol em high. Vamos verificar de onde ela veio.

A origem é uma publicação que um funcionário da OpenAI (Tibo) fez no X (antigo Twitter) em 6 de setembro de 2026. Na comunidade de desenvolvedores da OpenAI, alguém do lado da OpenAI também repete a ideia, escrevendo que a recomendação da empresa é tratar o GPT-6-Astra com raciocínio low como substituto do GPT-5.6-Sol em esforço alto.

🟡 Dito isso, trata-se de uma orientação dada numa publicação, não de algo garantido como especificação. A documentação para desenvolvedores da OpenAI não traz nem comparação entre um esforço e outro nem qualquer afirmação sobre eficiência de tokens (nós conferimos). O que ela de fato declara é que existem cinco níveis de esforço de raciocínio (low / medium / high / xhigh / max), além de preços e limites. Trate isso como uma referência aproximada e confirme no seu próprio trabalho.

Ou seja, sustentar o “o low basta” exige uma medição independente.

3. Os números medidos, esforço por esforço

A Artificial Analysis roda o seu Intelligence Index, um conjunto de vários benchmarks, em cada nível de esforço de raciocínio e publica, junto com a pontuação, o custo por tarefa e a contagem de tokens de saída. Estes são os valores em 18 de setembro de 2026.

Modelo e esforçoIntelligence IndexCusto por tarefaTokens de saídaTempo até o primeiro tokenVelocidade de geração
Astra low46$0.824,0002.74 segundos49 tok/s
Astra medium50$1.5410,0004.46 segundos46 tok/s
Astra high51$1.7212,00047.76 segundos46 tok/s
Astra xhigh53$2.3117,000154.86 segundos49 tok/s
Astra max53$3.2627,000300.45 segundos52.6 tok/s
Sol medium39$0.508,0004.74 segundos60 tok/s
Sol high42$0.8113,00011.91 segundos60 tok/s
Sol xhigh44$1.1820,00040.15 segundos66 tok/s
Sol max47$1.99129.63 segundos61.7 tok/s

Fontes: as páginas de comparação de modelos da Artificial Analysis (low vs high, medium vs high, high vs high, xhigh vs xhigh, low vs medium) e a página do modelo Sol. Os custos são calculados com o preço promocional do Sol. Os valores de tokens de saída são os números exibidos, arredondados para milhares, e cobrem a resposta e o raciocínio juntos. O valor de tokens de saída do Sol max foi omitido porque não conseguimos determiná-lo com segurança no gráfico

Três coisas saem daqui.

  • O Astra em low leva a melhor tanto sobre o Sol high quanto sobre o Sol xhigh. Custa quase o mesmo que o Sol high (42 pontos, $0.81) e pontua 4 pontos acima, e pontua 2 pontos acima do Sol xhigh (44 pontos, $1.18) custando 30 por cento menos. Ele não é, contudo, mais barato que o Sol medium (39 pontos, $0.50), de modo que essa comparação se reduz a saber se 7 pontos a mais valem $0.32
  • O Astra fica caro depressa conforme o esforço sobe. $1.54 em medium (cerca de 1.9 vez o Sol high) e $3.26 em max (cerca de 4 vezes). A pontuação sobe apenas 7 pontos, de 46 para 53
  • A única configuração do Sol que pontua acima do low do Astra é a max. Por esses 47 pontos, o custo é de $1.99, ou seja, 2.4 vezes mais

4. Por que os totais empatam

A razão de um preço unitário 2.5 vezes maior chegar ao mesmo total é que ele gasta um terço dos tokens. Uma multiplicação simples basta para conferir.

DetalhamentoAstra lowSol high
Tokens de saída (por tarefa)4,00013,000
Preço unitário da saída (por 1M de tokens)$50.00$20.00
Custo da parcela de saída (a partir dos valores exibidos)cerca de $0.20cerca de $0.26
Total por tarefa (entrada e cache incluídos)$0.82$0.81

Fontes: o custo da parcela de saída é cálculo nosso, a partir das contagens de tokens acima e dos preços unitários oficiais (4,000 x $50 / 1,000,000 = $0.20). As contagens de tokens estão arredondadas para milhares, então este cálculo também é aproximado. A Artificial Analysis publica ainda um gráfico que separa o custo por tipo de token (resposta, raciocínio, cache, entrada), mas os valores que conseguimos ler nele variavam, então a comparação aqui é feita pelos totais e pelos números exibidos. Os totais são os valores que a Artificial Analysis publica

Olhando só a saída, a coisa se inverte: mesmo com preço unitário 2.5 vezes maior, o Astra paga menos ($0.20 contra $0.26). Os totais acabam empatados porque o preço unitário mais alto do Astra então pesa na entrada e no cache que restam.

Daí sai uma referência prática. Quanto mais curta a entrada e quanto mais o trabalho for dominado pelo pensar, melhor se sai o Astra em low; quanto mais contexto você o obrigar a ler toda vez, pior. Tratamos do comportamento do contexto em O que é o contexto da IA? — A realidade do “lê, mas não lê” na era de 1M de tokens.

5. Velocidade: um quarto da espera

Se o custo empata, a velocidade vem em seguida. O Sol gera mais rápido por token (60 contra 49 tok/s) e, ainda assim, o tempo até a resposta estar inteira de volta é menor com o Astra low. A razão está no tempo de pensar (a espera pelo primeiro token) e na diferença de quantos tokens acabam sendo emitidos.

Modelo e esforçoTempo até o primeiro tokenTempo de geração (medido)Total
Astra low2.74 segundos91.69 segundoscerca de 94 segundos
Astra medium4.46 segundos209.95 segundoscerca de 214 segundos
Sol high11.91 segundos219.90 segundoscerca de 232 segundos
Sol xhigh40.15 segundos296.86 segundoscerca de 337 segundos
Astra max300.45 segundos522.00 segundoscerca de 822 segundos

Fonte: medições da Artificial Analysis (o tempo até o primeiro token e o tempo de geração por tarefa). Os totais são soma nossa. A métrica de tempo de geração é definida de forma a excluir a espera pelo primeiro token, e é por isso que as duas podem simplesmente ser somadas. Vale notar, porém, que o tempo de espera e a velocidade vêm de uma sondagem separada, que emite 500 tokens, enquanto o tempo de geração é a média por tarefa do índice, de modo que as duas medições têm origens diferentes

O Astra low termina em cerca de 1/2.5 do tempo de que o Sol high precisa. Se, em vez disso, você subir para max, vai esperar cinco minutos até o primeiro caractere aparecer (300.45 segundos). Em uso interativo, essa diferença de espera é sentida com mais força que o custo.

6. O dia em que a premissa muda: o preço promocional do Sol

A “quase paridade” de que falamos até aqui só se sustenta no preço promocional do Sol. Em 21 de agosto de 2026, a OpenAI anunciou que estava “reduzindo em mais de 20% o preço da API e dos créditos do GPT-5.6 Sol pelos próximos 3 meses” (entrada de $5 para $4, entrada em cache de $0.50 para $0.40, saída de $30 para $20; vale também para os créditos do ChatGPT Work e do Codex). Se o anúncio se confirmar, isso faz dele um preço por tempo limitado, que corre até o fim de novembro de 2026.

🟡 Nem uma declaração que nomeie a data de término nem o preço que vem depois dela saíram da OpenAI. Na mesma discussão, um usuário escreve “pelo menos até 21 de novembro de 2026” e afirma que os cortes do Terra e do Luna (Terra de $2.50 para $2.00 e de $15 para $12, Luna de $1.00 para $0.20 e de $6.00 para $1.20, em vigor desde 30 de julho de 2026) são permanentes, mas isso é a publicação de um usuário, não o anúncio da OpenAI.

Suponha que volte aos $5/$30 originais: entrada e cache sobem 1.25 vez, e a saída sobe 1.5 vez. De uma tarefa do Sol high ($0.81), cerca de $0.26 é a parcela de saída, então, com o restante a 1.25 vez e a saída a 1.5 vez, o total dá cerca de $1.08. Tomando os dois extremos, tudo puxado para a entrada ou tudo puxado para a saída, ele se mantém dentro de uma faixa de $1.01 a $1.22. De um jeito ou de outro, o Astra low ($0.82) sai de 20 a 30 por cento mais barato.

Agora (promoção em curso)

O custo empata

Astra low $0.82 / Sol high $0.81. Em pontuação e velocidade, o Astra low leva vantagem.

Depois que a promoção acabar (se o preço voltar)

O Astra low fica de 20 a 30 por cento mais barato

O Sol high sobe para cerca de $1.08 ($1.01 a $1.22 se você tomar os extremos). O Astra low continua em $0.82.

A decisão

Migrar agora dificilmente sai pela culatra

Os preços estão se movendo a favor do Astra. Ainda assim, meça no seu próprio trabalho antes de decidir.

7. Em codificação, a diferença diminui

Tudo o que veio até aqui diz respeito ao Intelligence Index, a pontuação geral. No índice que mede o trabalho de agentes de codificação, a diferença de preço diminui.

No índice geral, com ambos no esforço máximo, o Astra ($3.26) é cerca de 60 por cento mais caro que o Sol ($1.99). Já no índice de agentes de codificação, o Astra chega a $7.09 por tarefa, apenas cerca de 15 por cento acima do Sol. As pontuações são de 62 contra 55, o que põe o Astra 7 pontos à frente, e os tokens são um terço. Codificação, em outras palavras, é um terreno relativamente favorável ao Astra.

Dito isso, 🟡 o índice de codificação não publica os custos nos esforços mais baixos. A própria pergunta de que trata este artigo, se o low basta, está por verificar no caso da codificação. Pegue a referência que o índice geral de fato sustenta, “é um bom negócio se um esforço fraco bastar, e fica caro demais quando você aumenta tudo até o máximo”, e meça no seu próprio agente.

Fonte: Artificial Analysis, “Benchmarking GPT-6 Astra” (Coding Agent Index, comparação no esforço max. Publicado em 9 de setembro de 2026)

A propósito, há mais duas condições que fazem a conta do Astra disparar. Acima de 272,000 tokens de entrada, entrada e cache dobram e a saída sobe 1.5 vez. Na direção contrária, Batch e Flex custam metade, e Fast custa o dobro. Se o seu padrão é entregar um documento longo inteiro toda vez, é essa sobretaxa que vai pegar você.

8. Meça no seu próprio trabalho

Todos os números acima foram medidos sobre um sortimento de benchmarks. O seu trabalho é feito de outra coisa. Só decida depois de medir em tarefas que representem o que você realmente faz. São três passos.

  1. Rode o mesmo pedido nas duas configurações: ponha o Astra em low e o Sol em high, e envie as mesmas entradas de 5 a 10 vezes em cada um. Com uma única rodada, um pedido que por acaso pensou demais puxa o resultado para todo lado
  2. Leia os números da resposta, não os da fatura: registre as contagens de tokens que a resposta traz (entrada, saída, raciocínio). Multiplique pelo preço unitário e você tem o custo por pedido. O básico sobre preços de API está reunido em O que é uma API de IA? — Guia para iniciantes sobre preços, tokens e escolha de modelo
  3. Conte também as repetições: se o modelo barato não resolve numa passada e você o aciona duas vezes, o custo real é o dobro. Compare custo como “o total até o trabalho ficar pronto”, e não como “o preço de uma chamada”

FAQ

Q1. O low do Astra tem a mesma força que o low do Sol?
Não. Os nomes dos esforços são configurações de cada modelo, não uma escala comum. Nas medições, o Astra low (46 pontos) fica acima da segunda configuração mais alta do Sol, a xhigh (44 pontos). Compare por pontuação e custo, não pelo nome.

Q2. De qual esforço devo partir?
Começar em low e ir subindo é a escolha segura. O custo do Astra sobe de forma acentuada com o esforço: cerca de 1.9 vez o Sol high em medium e cerca de 4 vezes em max. A pontuação anda só 7 pontos, de 46 para 53, então quanto mais você aumenta, menos compensa.

Q3. Devo migrar quando o preço promocional acabar?
Os preços estão se movendo a favor do Astra. Se os $5/$30 originais voltarem, o Sol high fica entre $1.01 e $1.22, e o Astra low ($0.82) sai de 20 a 30 por cento mais barato. Dito isso, 🟡 o preço posterior à promoção não foi publicado.

Q4. Se ele usa um terço dos tokens, isso ajuda nos planos com limite de uso?
Na cobrança medida da API, sim. Mas nada publicado diz que o limite de uso de uma assinatura é consumido na proporção da contagem de tokens. Verifique como o seu plano trata isso à parte da questão de preço.

Q5. De quando são estes números?
As medições deste artigo são as que a Artificial Analysis publicava em 18 de setembro de 2026. Tanto os preços quanto os resultados por esforço são atualizados, então confira os valores atuais nas páginas de origem antes de decidir.

Fontes