Índice
- 1. O essencial do Sonnet 5.5: desempenho, preço e cuidados na migração
- 2. Especificações principais e onde está disponível
- 3. Preço: o mesmo do Sonnet 5, só muda o mínimo do cache
- 4. Benchmarks: lendo dentro da tabela da Anthropic
- 5. As cinco mudanças incompatíveis que dão erro 400 ao migrar do Sonnet 5, e como corrigir
- 6. Mudanças que acontecem sem nenhum erro
- 7. Effort padrão: high na API, medium no Claude Code
- 8. Como escolher entre Sonnet 5.5, Opus 5.5 e Haiku
- 9. Uso no Claude Code e no GitHub Copilot
- 10. Passos da migração (para quem usa a API)
- Resumo
- FAQ
Em 28 de setembro de 2026, a Anthropic lançou o Claude Sonnet 5.5. Segundo o anúncio, ele é o segundo modelo da família Claude 5.5, depois do Opus 5.5, lançado seis dias antes, e o Sonnet 5 anterior (lançado em 30 de junho de 2026) passou para Legacy (modelo antigo, mas ainda disponível). A lista oficial de modelos o descreve como o modelo com a melhor combinação de velocidade e inteligência.
Resumindo: o preço é exatamente o mesmo do Sonnet 5 ($2 de entrada, $10 de saída e $0,20 de leitura de cache por milhão de tokens) e, na tabela comparativa da Anthropic, ele melhora bastante em relação ao Sonnet 5 na maioria das linhas. Mas o comportamento da API mudou: há cinco mudanças que fazem um código que funcionava no Sonnet 5 dar erro 400. A principal é que thinking: {"type": "disabled"} deixou de servir para desligar o raciocínio, e o substituto, between_tools, só é aceito com effort high ou abaixo. Este artigo confronta a documentação oficial e o anúncio no texto original e organiza, na ordem prática, o que mudou, o que dá erro na migração e como escolher entre ele e o Opus 5.5.
Informações de 29 de setembro de 2026: escrito no dia seguinte ao lançamento, depois de ler no original a documentação oficial da Claude Platform (lista de modelos, página do Sonnet 5.5, What's new, guia de migração, preços, thinking, effort e cache de prompt), o anúncio da Anthropic, a documentação e o CHANGELOG do Claude Code e o changelog do GitHub. O Claude Haiku 5.5, que o anúncio promete "nas próximas semanas", ainda não tinha sido lançado nesta data.
Mesmo preço, cinco mudanças incompatíveis
— Posicionado oficialmente como a melhor combinação de velocidade e inteligência
1. O essencial do Sonnet 5.5: desempenho, preço e cuidados na migração
Na tabela comparativa da Anthropic, ele supera o Sonnet 5 em todas as linhas e, no GDPval-AA, fica a 2 pontos do Opus 5.5. Mas o próprio anúncio diz que "em trabalhos complexos e sem resposta definida, o Opus 5.5 continua claramente mais forte".
Os preços unitários são iguais aos do Sonnet 5 em todos os itens. O que mudou foi o tamanho mínimo que pode ir para o cache, que caiu de 1.024 para 512 tokens. O anúncio fala em "até 30% mais barato por tarefa", mas essa é uma medição da própria Anthropic.
São cinco: desligar o raciocínio agora é between_tools / uso forçado de ferramenta dá 400 / blocos de raciocínio vinculados ao modelo e à conversa / a ferramenta antiga de computer use não é aceita / combinações da ferramenta advisor. Além disso, o texto entre chamadas de ferramentas volta em blocos thinking.
Em uma frase: o Sonnet 5.5 é "um Sonnet um degrau acima, pelo mesmo preço, que se usa quase do mesmo jeito que o Opus 5.5". Das cinco mudanças incompatíveis, três (uso forçado de ferramenta, vínculo dos blocos de raciocínio e a ferramenta antiga de computer use) também existem no Opus 5.5 e no Fable 5.1. As particularidades exclusivas do Sonnet 5.5 são duas: a forma de desligar o raciocínio sobreviveu como um valor diferente, between_tools, e há restrições nas combinações da ferramenta advisor.
2. Especificações principais e onde está disponível
Para a comparação, escolhemos três modelos: o Sonnet 5, que ele substitui; o Opus 5.5, acima; e o Haiku 4.5, abaixo.
| Item | Sonnet 5.5 | Sonnet 5 (Legacy) | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| ID do modelo na API | claude-sonnet-5-5 |
claude-sonnet-5 |
claude-opus-5-5 |
claude-haiku-4-5-20251001 |
| Preço (entrada/saída) | $2 / $10 | $2 / $10 | $4 / $20 | $1 / $5 |
| Contexto / saída máxima | 1 milhão / 128 mil | 1 milhão / 128 mil | 1 milhão / 128 mil | 200 mil / 64 mil |
| Raciocínio (thinking) | Raciocínio adaptativo por padrão (o mínimo é between_tools) |
Raciocínio adaptativo por padrão (desliga com disabled) |
Raciocínio adaptativo sempre ligado (não desliga) | Raciocínio estendido (com orçamento definido) |
| Effort padrão na API | high | high | medium | Não suportado |
| Data de corte confiável do conhecimento | Junho de 2026 | Janeiro de 2026 | Junho de 2026 | Fevereiro de 2025 |
| Tamanho mínimo para cache | 512 tokens | 1.024 tokens | 512 tokens | 4.096 tokens |
| Velocidade (classificação relativa oficial) | Rápido | — | Moderado | O mais rápido |
| Descontinuação | Não antes de 28 de setembro de 2027 | Não antes de 30 de junho de 2027 | Não antes de 22 de setembro de 2027 | Não antes de 15 de outubro de 2026 |
Fontes: Anthropic, "Models overview", "Claude Sonnet 5.5", "Claude Sonnet 5", "Prompt caching" (verificadas em 29 de setembro de 2026). A velocidade é uma classificação relativa dentro da linha atual, e o Sonnet 5, que é Legacy, não aparece nela. As datas de descontinuação são compromissos para as plataformas operadas pela Anthropic; no Amazon Bedrock e no Google Cloud, cada empresa define as suas.
Na tabela, o Sonnet 5.5 difere do Sonnet 5 em apenas três linhas: "raciocínio", "data de corte do conhecimento" e "tamanho mínimo para cache". Contexto, saída máxima e effort padrão na API são iguais, e o tokenizador também é o mesmo do Sonnet 5, então o mesmo texto gera o mesmo número de tokens (What's new). Na Message Batches API, adicionar o cabeçalho beta output-300k-2026-03-24 amplia o limite de saída para 300 mil tokens (igual ao Sonnet 5). Vale lembrar que enviar valores diferentes do padrão em temperature, top_p ou top_k dá 400. Isso já acontecia no Sonnet 5 e só importa para quem migra direto do Sonnet 4.6 ou anterior.
Onde está disponível
API do Claude (claude-sonnet-5-5), Amazon Bedrock (anthropic.claude-sonnet-5-5), Claude Platform on AWS, Google Cloud e Microsoft Foundry. Saiu em todas as plataformas já no dia do lançamento.
claude.ai e os apps do Claude (a Anthropic publicou o prompt de sistema do Sonnet 5.5), Claude Code (v2.1.284 em diante) e GitHub Copilot (Pro, Pro+, Max, Business e Enterprise).
O fast mode (versão rápida) só cobre, na página de preços, o Opus 5.5, o Opus 5 e o Opus 4.8; o Sonnet 5.5 não tem. No Bedrock, as saídas estruturadas (incluindo strict tool use) não funcionam com o Sonnet 5.5 (guia de migração).
3. Preço: o mesmo do Sonnet 5, só muda o mínimo do cache
O What's new oficial diz que o preço é "o mesmo do Sonnet 5, e os preços do cache de prompt e do processamento em lote também são iguais". Os preços unitários detalhados são estes.
| Por milhão de tokens | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| Entrada | $2 | $2 | $4 | $1 |
| Saída | $10 | $10 | $20 | $5 |
| Gravação de cache (5 min) | $2,50 | $2,50 | $5 | $1,25 |
| Gravação de cache (1 hora) | $4 | $4 | $8 | $2 |
| Leitura de cache | $0,20 | $0,20 | $0,20 | $0,10 |
| Batch API (entrada/saída) | $1 / $5 | $1 / $5 | $2 / $10 | $0,50 / $2,50 |
Fonte: Anthropic, "Pricing" (verificada em 29 de setembro de 2026). A Batch API tem 50% de desconto sobre o preço normal, tanto na entrada quanto na saída.
Duas coisas que mudam dentro do "mesmo preço"
Preço unitário igual não garante conta igual. Há dois fatores que podem mudar.
O primeiro é o tamanho mínimo para cache. No Sonnet 5, prompts com menos de 1.024 tokens não iam para o cache, mesmo com cache_control. No Sonnet 5.5, esse mínimo caiu para 512 tokens. Por exemplo, um processo que envia a cada vez um prompt de system e definições de ferramentas somando 800 tokens ficava fora do cache no Sonnet 5, mas vai para o cache no Sonnet 5.5. Dá para ver se houve cache pelo usage da resposta: se cache_creation_input_tokens e cache_read_input_tokens forem ambos 0, nada foi para o cache (página oficial de Prompt caching). Como não aparece erro quando o mínimo não é atingido, vale aproveitar a migração para verificar processos em que o cache silenciosamente não estava funcionando.
O segundo é o número de tokens por tarefa. O anúncio diz que "o mesmo trabalho exige muito menos tokens; nos testes da Anthropic, é até 30% mais barato por tarefa" e que "a geração da saída é mais de 30% mais rápida que a do Sonnet 5". São medições da própria Anthropic. Por outro lado, a documentação oficial diz que os níveis de effort foram "recalibrados", então o mesmo nível não necessariamente raciocina tanto quanto no Sonnet 5. Os tokens de raciocínio são cobrados como tokens de saída, mesmo quando não são exibidos. Depois de migrar, o único jeito é medir o usage e comparar de novo com o seu próprio trabalho.
Simulação: uma tarefa com 10 milhões de tokens de leitura de cache, 500 mil de entrada e 300 mil de saída (os números de tokens são uma suposição deste artigo; o custo de gravação foi omitido)
- Sonnet 5.5: $2,00 + $1,00 + $3,00 = $6,00 (o Sonnet 5 dá o mesmo)
- Opus 5.5: $2,00 + $2,00 + $6,00 = $10,00 (cerca de 1,7 vez o Sonnet 5.5, e não o dobro)
- Haiku 4.5: $1,00 + $0,50 + $1,50 = $3,00 (exatamente metade do Sonnet 5.5)
É um cálculo de preço unitário com o mesmo número de tokens; na prática, cada modelo usa uma quantidade diferente de tokens. Preços unitários conforme "Pricing" da Anthropic.
A diferença para o Opus 5.5 não chega ao "dobro" porque a leitura de cache custa os mesmos $0,20 também no Opus 5.5. Quanto maior a proporção de cache num trabalho de agente, menor a economia de escolher o Sonnet 5.5. Os preços de todos os modelos Claude estão reunidos na comparação de preços entre Opus, Sonnet e Haiku.
4. Benchmarks: lendo dentro da tabela da Anthropic
A tabela comparativa do anúncio tem quatro colunas: Sonnet 5.5, Sonnet 5, Opus 5.5 e GPT-6 Sol. Antes, as condições da tabela.
- A tabela é a do anúncio da Anthropic, e a maioria das linhas traz valores medidos pela própria Anthropic. As exceções são GDPval-AA v2.1 e AA-Briefcase v1.1, executados pela Artificial Analysis (nota 3 da tabela).
- Essa medição da Artificial Analysis foi feita num ambiente de pré-lançamento que tinha um bug capaz de degradar as respostas de solicitações com saídas estruturadas. A Anthropic anota que "o impacto, se houver, é pequeno e no sentido de subestimar a pontuação" e diz que o bug já foi corrigido.
- O Terminal-Bench 4.0 do Opus 5.5 é o valor em xhigh, a maior pontuação do Opus 5.5 (nota 1). Para o FrontierCode, o Sonnet 5.5 tem dois valores: 46,2% em max e 52,1% em xhigh (nota 2).
- O GDPval-AA, o AA-Briefcase e o Chartography do GPT-6 Sol têm uma nota dizendo que podem ser valores anteriores à correção, pela OpenAI, de um bug de compreensão de imagens (nota 4).
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 Programação agêntica no terminal |
70,6% | 10,3% | 66,4% (xhigh) | — |
| FrontierCode 1.1 (Main) Se a alteração é aceita no merge |
52,1% (xhigh) 46,2% (max) |
42,4% | 54,4% | 49,3% |
| CursorBench 4.0 Tarefas ambíguas em vários arquivos |
55,5% | 34,1% | 57,8% | — |
| GDPval-AA v2.1 (Elo) Trabalho real de 44 profissões (executado pela Artificial Analysis) |
1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 (Elo) Trabalho intelectual de longa duração (executado pela Artificial Analysis) |
1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam Raciocínio multidisciplinar (com ferramentas) |
64,5% | 54,9% | 67,7% | — |
| OSWorld 2.1 Operação do computador (a nota da tabela diz "partial") |
80,1% | 57,0% | 81,8% | — |
| Chartography Leitura de gráficos (sem ferramentas) |
61,6% | 15,6% | 64,4% | 53,6% |
Fonte: tabela comparativa e notas de "Introducing Claude Sonnet 5.5", da Anthropic (28 de setembro de 2026, verificada em 29 de setembro). Em negrito, o maior valor de cada linha. "—" indica que não há valor na tabela. Os detalhes de medição estão no system card do Sonnet 5.5, indicado no mesmo anúncio.
Dá para tirar três conclusões.
- O salto em relação ao Sonnet 5 é grande. No Terminal-Bench 4.0, foi de 10,3% para 70,6%, e no Chartography (sem ferramentas), de 15,6% para 61,6%: várias vezes mais, dentro da mesma tabela. No GDPval-AA, subiu cerca de 400 pontos.
- A diferença para o Opus 5.5 fica dentro de poucos pontos na maioria das linhas. São 2 pontos no GDPval-AA, 2,3 pontos percentuais no CursorBench e 1,7 ponto percentual no OSWorld 2.1. No Terminal-Bench 4.0, ele supera o maior valor do Opus 5.5 (66,4% em xhigh).
- Mesmo assim, a Anthropic coloca o Opus 5.5 acima. O anúncio diz que "os benchmarks captam só uma parte da capacidade. Tanto internamente quanto com testadores externos, o Opus 5.5 continua claramente mais forte em trabalhos complexos e sem resposta definida, que exigem sustentar o julgamento".
Custo por nível de effort: das descrições dos gráficos do anúncio
O anúncio também traz gráficos com a pontuação e o custo por tarefa em cada nível de effort. Veja o que dizem as descrições desses gráficos.
Em medium, o padrão dos apps do Claude, supera com folga a maior pontuação do Sonnet 5, com menos de um décimo do custo por tarefa.
Em high, o padrão da Claude Platform, empata com a maior pontuação do GPT-6 Sol, com cerca de um quinto do custo por tarefa. Fica 10 pontos acima do Sonnet 5 no mesmo high, com cerca de um quinze avos do custo.
No nível mais baixo, low, supera a maior pontuação do Sonnet 5, com menos de um décimo do custo por tarefa.
Em medium, supera a maior pontuação do Sonnet 5, com cerca de um nono do custo por tarefa.
Fonte: descrições dos gráficos de "Introducing Claude Sonnet 5.5", da Anthropic. Nos gráficos do Terminal-Bench e do CursorBench, aparece o GPT-5.6 Sol, porque os valores do GPT-6 Sol não foram publicados (nota da mesma página).
O que merece atenção aqui são os dois valores do FrontierCode. No Sonnet 5.5, o max (46,2%) é menor que o xhigh (52,1%). Segundo a nota do anúncio da Anthropic, em max ele passa a rodar com mais frequência a skill de revisão de código do Claude Code e divide o trabalho entre muitos subagentes, o que em alguns casos levou a estouro de tempo e a edições fora do escopo da tarefa. Subir o effort não garante melhora, então o nível deve ser decidido comparando no seu próprio trabalho (seção 7). Os números do GPT-6 Sol estão no guia de lançamento do GPT-6 Sol e Luna.
Não misture com a tabela do anúncio do Opus 5.5: para o mesmo Opus 5.5, o Chartography aparece como 89,0% "com ferramentas" no anúncio do Opus 5.5 e como 64,4% "sem ferramentas" na tabela atual, ou seja, com condições diferentes. Pegar números dos dois anúncios e colocá-los lado a lado significa comparar valores medidos em condições diferentes. Se for comparar, fique entre colunas da mesma tabela.
5. As cinco mudanças incompatíveis que dão erro 400 ao migrar do Sonnet 5, e como corrigir
O What's new in Claude Sonnet 5.5 oficial lista cinco mudanças incompatíveis (breaking changes) que afetam código que funciona no Sonnet 5. Em todas, o erro é 400 invalid_request_error.
① Para desligar o raciocínio, use between_tools em vez de disabled
No Sonnet 5, thinking: {"type": "disabled"} desligava o raciocínio em qualquer effort. No Sonnet 5.5, disabled dá 400, com a seguinte mensagem.
"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
O substituto é thinking: {"type": "between_tools"}, a configuração de raciocínio mais baixa deste modelo, que suspende o "raciocínio preliminar" feito de uma vez antes da resposta. Em solicitações sem ferramentas, a resposta traz só o texto, como no disabled do Sonnet 5. Não precisa de cabeçalho beta e funciona em qualquer plataforma que ofereça o Sonnet 5.5. Mas, se você trocar achando que é igual ao disabled, vai tropeçar em três pontos.
- Com effort xhigh ou max, dá 400. O
between_toolssó passa em low, medium e high. Processos que no Sonnet 5 usavam "xhigh + raciocínio desligado" terão de escolher entre baixar o effort para high ou menos e deixar de desligar o raciocínio. - Não dá para enviar outros campos junto. Enviar
display,budget_tokensoublock_bindingjunto combetween_toolsdá 400. - Não dá para mudar o effort no meio da conversa. Enviar, pelo effort por mensagem (beta), um nível diferente do atual dá 400. Se quiser mudar o nível a cada turno, use o raciocínio adaptativo (omita
thinkingou use{"type": "adaptive"}).
Abaixo, o exemplo de antes e depois do guia de migração, em Python. Repare que, como o exemplo de antes usa xhigh, o de depois baixa para high.
# Antes: passa no Sonnet 5. No Sonnet 5.5 dá 400 client.messages.create( model="claude-sonnet-5", max_tokens=16000, thinking={"type": "disabled"}, output_config={"effort": "xhigh"}, messages=[{"role": "user", "content": "..."}], ) # Depois: suspende o raciocínio preliminar. Effort em high ou abaixo client.messages.create( model="claude-sonnet-5-5", max_tokens=16000, thinking={"type": "between_tools"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )
Mesmo com between_tools, as notas curtas de progresso escritas entre chamadas de ferramentas voltam em blocos thinking com um texto de resumo. Não descarte esses blocos: devolva-os como estão, junto com o restante do turno do assistente. Pelos blocos devolvidos, o texto completo das notas escritas pelo modelo chega ao modelo (What's new). O orçamento manual {"type": "enabled", "budget_tokens": N} continua dando 400, como no Sonnet 5.
② O uso forçado de ferramenta dá erro
Definir tool_choice como {"type": "any"} ou {"type": "tool", "name": "..."} dá 400. A API de contagem de tokens aplica a mesma regra. Só são aceitos auto (padrão) e none.
tool_choice: type "tool" and "any" are not supported for this model.
Correção: mantenha tool_choice em auto e adicione strict: true à definição da ferramenta (strict tool use), ou passe o esquema para saídas estruturadas. Com auto, o modelo pode responder em texto sem chamar a ferramenta, então escreva no prompt "em que situação usar essa ferramenta". O strict tool use aceita só uma parte do JSON Schema, e todo object dentro do esquema precisa de additionalProperties: false. Por solicitação, no máximo 20 ferramentas podem ser strict, e os conjuntos de ferramentas de MCP, computer use e browser use não aceitam strict.
# Antes: passa no Sonnet 5. No Sonnet 5.5 dá 400 client.messages.create( model="claude-sonnet-5", max_tokens=1024, tools=tools, tool_choice={"type": "tool", "name": "get_weather"}, messages=[{"role": "user", "content": "What's the weather in Paris?"}], ) # Depois: auto + strict. Diga em texto quando usar a ferramenta client.messages.create( model="claude-sonnet-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}], )
No Amazon Bedrock, a situação é outra. Como no Sonnet 5.5 do Bedrock as saídas estruturadas (incluindo strict tool use) não funcionam, envie auto sem strict, escreva no prompt quando chamar a ferramenta e valide a entrada da ferramenta no seu próprio código (guia de migração).
③ Os blocos de raciocínio ficam vinculados ao modelo e à conversa
Os blocos thinking registram qual modelo os criou. O Sonnet 5.5 consegue ler blocos de raciocínio do Sonnet 5, do Opus 4.8, do Haiku 4.5 e de modelos anteriores, mas não os do Opus 5, do Opus 5.5, do Fable nem do Mythos. E nenhum outro modelo consegue ler os blocos de raciocínio do Sonnet 5.5.
- A troca Sonnet 5 → Sonnet 5.5 herda o raciocínio feito até ali.
- Na troca Sonnet 5.5 → qualquer outro modelo, os turnos depois da troca rodam sem o raciocínio do Sonnet 5.5. A solicitação em si é bem-sucedida, e os blocos descartados não são cobrados.
Os blocos de raciocínio do Opus 5.5 podem ser lidos pelo Fable 5.1 e pelo Mythos 5.1, mas os do Sonnet 5.5 não podem ser lidos por ninguém. Se você montou um roteamento do tipo "subir só as partes difíceis do Sonnet 5.5 para o Opus 5.5", precisa verificar partindo do princípio de que, no destino, o raciocínio do Sonnet 5.5 desaparece.
Além disso, é verificado se o que vem antes do bloco de raciocínio do Sonnet 5.5 (system, tools e as mensagens anteriores) não mudou depois que o bloco foi criado. Em contas criadas a partir de 31 de agosto de 2026, 0h (UTC), isso é aplicado por padrão na API do Claude, no Amazon Bedrock e no Google Cloud, e enviar o bloco num histórico reescrito no meio do caminho dá 400.
Correção: faça a conversa avançar só acrescentando. Para mudar instruções ou ferramentas, use mensagens de system no meio da conversa em vez de reescrever o histórico (recurso que passou a funcionar no Sonnet 5.5 e que o Sonnet 5 não tinha). Se reescrever for inevitável, adicione o cabeçalho beta thinking-binding-controls-2026-08-01 e defina thinking.block_binding.prefix_mismatch_behavior como "drop_block": em vez de dar erro, o bloco em questão é descartado. Porém, como block_binding só funciona com o raciocínio adaptativo, com between_tools, ou você só acrescenta, ou remove por conta própria os blocos thinking a partir do turno reescrito.
④ Na API do Claude e no Google Cloud, a ferramenta antiga de computer use não funciona
O Sonnet 5 aceitava a operação do computador (computer use) também pela ferramenta antiga computer_20251124, com cabeçalho beta. O Sonnet 5.5 na API do Claude e no Google Cloud aceita só o conjunto de ferramentas computer_toolset_20260801, e declarar a ferramenta antiga dá 400. Na API do Claude, a mensagem começa com a frase a seguir.
'claude-sonnet-5-5' does not support tool types: computer_20251124.
Correção: remova o cabeçalho beta, troque tools por [{"type": "computer_toolset_20260801"}] e ajuste o loop do agente ao formato do conjunto de ferramentas (blocos tool_use dos membros, várias ações de uma vez e toolset_name nos resultados). Se você envia o cabeçalho beta fine-grained-tool-streaming-2025-05-14, remova-o. Como enviá-lo junto com o conjunto de ferramentas dá 400, adicione eager_input_streaming: true a cada ferramenta que precisar. No Amazon Bedrock, a ferramenta antiga continua funcionando, então nada precisa mudar.
⑤ Algumas combinações da ferramenta advisor não são aceitas
A ferramenta advisor (beta) é um mecanismo em que o modelo executor pede conselho a um modelo mais forte. Quando o Sonnet 5.5 é o executor, indicar como conselheiro o Opus 4.8, o Opus 4.7, o Opus 4.6, o Sonnet 5 ou o Sonnet 4.6 dá 400. Os aceitos são: Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 e Mythos 5.1.
Além disso, todos os conselheiros aceitos pelo Sonnet 5.5 devolvem o conselho criptografado, em blocos advisor_redacted_result, então o texto do conselho não pode ser lido no lado do cliente. Processos que registravam o conteúdo do conselho em log ou o mostravam na tela precisam ser refeitos. Combinações baratas como "Sonnet 5 de executor e Opus 4.8 de conselheiro" não podem ser usadas assim no Sonnet 5.5.
6. Mudanças que acontecem sem nenhum erro
As cinco mudanças incompatíveis dão 400, então você percebe. O problema são as que mudam só o comportamento, sem dar erro.
| Mudança | O que acontece e como lidar |
|---|---|
| O texto entre chamadas de ferramentas vai para blocos thinking | Notas com mais de uma ou duas frases, como "agora vou verificar X", que no Sonnet 5 eram blocos text, voltam em blocos thinking de progresso (comentários curtos continuam como text). Com o display: "omitted" padrão, o conteúdo vem vazio, então telas que mostravam o andamento ao usuário ficam em silêncio durante as chamadas de ferramentas. Com o raciocínio adaptativo, defina display como "updates" (beta, cabeçalho thinking-display-updates-2026-08-18) ou "summarized" e exiba os blocos thinking não vazios antes do tool_use que vem em seguida. Com between_tools, o texto volta sem configuração nenhuma. |
| Os níveis de effort foram recalibrados | O mesmo nível não necessariamente raciocina tanto quanto no Sonnet 5. A orientação oficial é "não herde as configurações; reajuste o effort" (seção 7). |
| Agora são cinco categorias de recusa | cyber, bio, frontier_llm, reasoning_extraction e general_harms. Quando há recusa, volta HTTP 200 com stop_reason: "refusal", então é preciso ler stop_details e tratar o caso. O fallback no lado do servidor (fallbacks: "default", beta, só na API do Claude) tenta de novo no Sonnet 5 apenas cyber e frontier_llm. |
| Os blocos de raciocínio ficam vinculados à conta que os criou | Os blocos de raciocínio do Sonnet 5.5 só podem ser usados pela conta que os criou ou por contas ligadas a ela. Se forem enviados por outra conta, os blocos são descartados e a solicitação é bem-sucedida. O anúncio diz que isso "inclui trocar de conta no meio de uma sessão do Claude Code". |
| O mínimo do cache caiu | Prompts de 512 a 1.023 tokens passam a ir para o cache. Passa a haver custo de gravação (1,25 vez o preço de entrada, no caso de 5 minutos), mas a partir da segunda vez paga-se só o preço de leitura (seção 3). |
Fontes: What's new in Claude Sonnet 5.5, Migrating to Claude Sonnet 5.5 e o anúncio da Anthropic
O anúncio também descreve mudanças nas salvaguardas de segurança. O Sonnet 5.5 é o primeiro Sonnet lançado com salvaguardas e fallback para cibersegurança, porque sua capacidade de uso em ciberataques chegou ao nível do Opus 5, e trabalhos de cibersegurança de alto risco passam para o Sonnet 5 de forma visível. A detecção e a correção de bugs no desenvolvimento do dia a dia não são afetadas. As salvaguardas de biologia são as mesmas do Sonnet 5.
Por outro lado, também há recursos novos. O effort por mensagem (beta; permite mudar o nível mantendo o cache de prompt), as mensagens de system no meio da conversa e a troca de ferramentas no meio da conversa (beta) não existiam no Sonnet 5. O What's new também lista a compactação, que resume a conversa quando você quiser (beta, cabeçalho compact-2026-09-04), e a definição de ferramentas dentro das mensagens (beta, cabeçalho inline-tools-2026-09-15).
7. Effort padrão: high na API, medium no Claude Code
No Opus 5.5, o effort padrão caiu para medium também na API, mas no Sonnet 5.5 o padrão da API continua high. Já o anúncio diz que "no Claude Code e nos apps, o padrão passou a ser medium". Com o mesmo Sonnet 5.5, a profundidade quando você não especifica nada difere em um nível entre a API e o Claude Code.
A página oficial de effort recomenda os seguintes pontos de partida para o Sonnet 5.5.
| Tipo de trabalho | Nível inicial (recomendação oficial) | Observações |
|---|---|---|
| Trabalho em geral (fora os dois abaixo) | high | Igual ao padrão da API |
| Programação agêntica e uso de ferramentas em várias etapas | A partir de medium | Trabalho com especificação clara em medium; trabalho difícil ou longo, suba para high |
| Trabalho sensível à latência, como chat | medium ou low | Prioriza a velocidade |
| xhigh e max | Só quando a avaliação mostrar ganho de qualidade | Não podem ser usados junto com between_tools |
Fontes: seção "Recommended effort levels for Claude Sonnet 5.5" de "Effort", da Anthropic, e o guia de migração
A mesma página também recomenda definir max_tokens com espaço para o raciocínio e para o texto e, em programação agêntica, definir max_tokens no limite deste modelo, 128.000, e receber por streaming. Mesmo com configurações em que o conteúdo do raciocínio não é devolvido, os tokens de raciocínio contam para max_tokens. O funcionamento do effort em si está no guia da configuração de esforço (effort), e o raciocínio adaptativo, em diferença entre raciocínio adaptativo e raciocínio estendido.
8. Como escolher entre Sonnet 5.5, Opus 5.5 e Haiku
A orientação da lista oficial de modelos continua "na dúvida, comece pelo Opus 5.5"; o Sonnet 5.5 não virou o ponto de partida. Dito isso, o anúncio separa os pontos fortes do Sonnet 5.5, "trabalho do dia a dia com escopo claro, correção de bugs e criação de documentos, slides e planilhas", dos do Opus 5.5, "trabalho complexo que exige julgamento cuidadoso". E acrescenta que "o Sonnet 5.5 complementa melhor o Opus 5.5 com effort mais baixo. Nos níveis altos, pode chegar a desempenho parecido com custo parecido". Ou seja, se você vai rodar em xhigh ou max, escolher o Sonnet 5.5 traz pouca vantagem de custo.
- Você quer rodar rápido, de low a high, implementações e correções de bugs com especificação clara.
- Você cria muitos documentos, slides e planilhas.
- Você quer desligar o raciocínio preliminar para reduzir a espera (
between_tools). - Você usa o Sonnet 5 (dá para substituir pelo mesmo preço).
- Em projetos ou pesquisas sem resposta definida, é preciso sustentar o julgamento.
- Você não consegue decidir entre os dois (é o ponto de partida oficial).
- Você pretende rodar com effort alto, e a diferença de custo para o Sonnet 5.5 diminui.
- Você quer usar o fast mode (só no Opus).
- O volume é grande e o preço por item é a prioridade (o Haiku 4.5 custa metade do Sonnet 5.5).
- Um contexto de 200 mil tokens basta.
- O Haiku 5.5 foi anunciado para "as próximas semanas".
- A descontinuação do Haiku 4.5 é "não antes de 15 de outubro de 2026", então confira os planos futuros.
Na dúvida, siga esta ordem: ① rode o Sonnet 5.5 em medium e em high no seu trabalho → ② se não bastar, compare com o Opus 5.5 em medium → ③ se o Sonnet 5.5 em xhigh custar o mesmo que o Opus 5.5, escolha o Opus 5.5. Os detalhes do Opus 5.5 estão no guia de lançamento do Opus 5.5, e a lista de todos os modelos até esta data está em principais modelos de IA e suas datas de corte do conhecimento.
9. Uso no Claude Code e no GitHub Copilot
O Claude Code adicionou o Sonnet 5.5 no CHANGELOG da v2.1.284 (28 de setembro de 2026) e o tornou o Sonnet padrão na API da Anthropic.
O default continua sendo o Opus 5.5 nos planos Pro, Max, Team e Enterprise e na API. Para usar o Sonnet 5.5, escolha /model sonnet (ao iniciar, claude --model sonnet). Versões anteriores à v2.1.284 não têm o modelo, então rode claude update.
sonnet muda conforme o provedorEle vira Sonnet 5.5 só na API da Anthropic. Na Claude Platform on AWS aponta para o Sonnet 4.6, e no Bedrock, no Agent Platform do Google Cloud e no Microsoft Foundry, para o Sonnet 4.5. Nesses casos, escolha o nome completo do modelo ou defina ANTHROPIC_DEFAULT_SONNET_MODEL.
O Sonnet 5.5 começa em medium. O effortLevel no formato antigo, no nível mais alto das configurações do usuário, não tem efeito nos modelos a partir do Opus 5.5. O botão de raciocínio, alwaysThinkingEnabled e MAX_THINKING_TOKENS=0 também não têm efeito no Sonnet 5.5.
Quando o classificador das salvaguardas reage, o trabalho de cibersegurança é executado de novo no Sonnet 5 e a sessão continua nesse modelo (para voltar, use /model). Para biologia, o Sonnet 5.5 não tem modelo substituto, e tudo termina em recusa.
Fontes: "Model configuration" do Claude Code e o CHANGELOG (v2.1.284, verificados em 29 de setembro de 2026)
Quanto ao contexto, na API da Anthropic o Sonnet 5.5 também tem sempre 1 milhão de tokens, sem precisar indicar [1m] nem pagar a mais. A compactação automática (auto-compact) roda por padrão em cerca de 967 mil tokens. Via gateway de LLM (com ANTHROPIC_BASE_URL definido), ele é tratado como 200 mil tokens, então escolha "Sonnet 5.5 (1M context)" (sonnet[1m]) no seletor de modelos.
O opusplan, que divide o planejamento no Opus e a execução no Sonnet, roda na API da Anthropic com o Opus 5.5 e o Sonnet 5.5, respectivamente. O uso está explicado no guia do opusplan. Como o próprio Claude Code faz a conversa avançar só acrescentando, a verificação do histórico da seção 5 ③ não causa problemas (conforme o guia de migração do Opus 5.5).
GitHub Copilot
No changelog do mesmo 28 de setembro, o GitHub anunciou a disponibilidade geral do Sonnet 5.5. Vale para o Copilot Pro, Pro+, Max, Business e Enterprise, e ele pode ser escolhido no seletor de modelos do VS Code, do Visual Studio, do Copilot CLI, do Copilot coding agent, do github.com, das IDEs JetBrains, do Xcode e de outros. A liberação é gradual, então pode não aparecer na hora. A cobrança é por uso, com o preço de tabela do provedor. No Business e no Enterprise, o administrador decide se ele pode ser usado, na política de modelos das configurações do Copilot.
10. Passos da migração (para quem usa a API)
Da checklist do guia de migração, reunimos na ordem de execução os itens que se aplicam a quem vem do Sonnet 5. O Claude Code também tem o /claude-api migrate para ajudar nesse trabalho (uma skill incluída, indicada no guia de migração, que confirma o escopo antes de editar).
- Troque o ID do modelo de
claude-sonnet-5paraclaude-sonnet-5-5(no Bedrock,anthropic.claude-sonnet-5-5). - Substitua
thinking: {"type": "disabled"}por{"type": "between_tools"}e deixe o effort em high ou abaixo. - Substitua
anyetoolemtool_choiceporauto+ strict tool use (no Bedrock, sóauto, validando a entrada por conta própria). - Se você reescreve
system,toolsou mensagens anteriores no meio do caminho, passe para um formato em que só se acrescenta. - Se usa computer use na API do Claude ou no Google Cloud, migre para
computer_toolset_20260801e ajuste o loop. - Se o conselheiro da ferramenta advisor é o Opus 4.8, o Opus 4.7, o Sonnet 5 ou outro do tipo, troque por um conselheiro aceito pelo Sonnet 5.5 e conte com o conselho voltando criptografado.
- Se você mostra o andamento na tela, defina
displaycomo"updates"ou"summarized"(desnecessário combetween_tools). - Trate
stop_reason: "refusal"e configure o fallback. - Se há um mecanismo de roteamento para outros modelos, verifique partindo do princípio de que o raciocínio do Sonnet 5.5 não é herdado.
- Reajuste o effort e meça de novo o custo e a latência. Confira também o cache dos prompts com menos de 1.024 tokens.
Fonte: as seções "Every starting model" e "Migrating to Claude Sonnet 5.5 from Claude Sonnet 5" de "Migrating to Claude Sonnet 5.5", da Anthropic, reorganizadas na ordem de execução
Quem vem direto do Sonnet 4.6 ou anterior precisa lidar também com o fato de que o raciocínio passa a rodar mesmo em processos que não o especificavam, com os erros 400 do orçamento de raciocínio e de temperature e afins, e com o aumento de cerca de 30% nos tokens para o mesmo texto. Se você usa o Claude Managed Agents, basta trocar o nome do modelo (nota do guia de migração).
Resumo
O Claude Sonnet 5.5 é um lançamento que aumenta muito o desempenho mantendo o preço e, em troca, aproxima a forma de usar a API da do Opus 5.5. Na própria tabela da Anthropic, ele melhora em todas as linhas em relação ao Sonnet 5 e, na maioria delas, fica a poucos pontos do Opus 5.5. Por outro lado, disabled, o uso forçado de ferramenta, a ferramenta antiga de computer use, a reescrita do histórico e algumas combinações do advisor passaram a causar erro 400.
O mais fácil de deixar passar é que o between_tools, substituto para desligar o raciocínio, só passa em high ou abaixo, e a divergência de que o effort padrão é high na API e medium no Claude Code. Na API, especifique o effort; no Claude Code, escolha com /model sonnet e confira o nível de esforço. Se ficou mais barato, meça pelo usage, e não pelo preço unitário.
Por fim, os números de benchmark são valores medidos naquela tabela, naquelas condições. A própria Anthropic escreve que "em trabalhos complexos e sem resposta definida, o Opus 5.5 é claramente mais forte". Comece comparando o Sonnet 5.5 em medium e em high no seu próprio trabalho.
FAQ
Q. O Sonnet 5.5 é mais caro que o Sonnet 5?
A. Os preços unitários são iguais em todos os itens ($2 de entrada, $10 de saída, $0,20 de leitura de cache e metade do preço na Batch API). A Anthropic fala em "até 30% mais barato por tarefa", mas essa é uma medição própria. Como os níveis de effort foram recalibrados, confira pelo usage depois de migrar.
Q. Tem como desligar o raciocínio (thinking)?
A. Na API, thinking: {"type": "between_tools"} suspende o raciocínio preliminar. Em solicitações sem ferramentas, a resposta traz só o texto. Mas com effort xhigh ou max dá 400, e as notas de progresso entre ferramentas voltam em blocos thinking. No Claude Code, as configurações para desligar o raciocínio do Sonnet 5.5 não têm efeito.
Q. Troquei o ID do modelo e apareceu um erro 400.
A. Dá para identificar pela mensagem de erro. "thinking.type.disabled" indica a configuração de raciocínio; tool_choice: type "tool" and "any", o uso forçado de ferramenta; e computer_20251124, a ferramenta antiga de computer use. Se apareceu usando between_tools, veja se o effort está em xhigh ou acima, ou se você enviou display ou outro campo junto. Se usa a ferramenta advisor, suspeite do modelo conselheiro; se reescreve o histórico no meio da conversa, suspeite da verificação dos blocos de raciocínio (seção 5 ③).
Q. O Claude Code não está usando o Sonnet 5.5.
A. O modelo padrão é o Opus 5.5, então escolha com /model sonnet. Se mesmo assim continuar no Sonnet 5, sua versão é anterior à v2.1.284: rode claude update. No Bedrock, no Google Cloud, na Claude Platform on AWS e no Microsoft Foundry, sonnet aponta para um Sonnet mais antigo, então escolha o nome completo do modelo ou defina ANTHROPIC_DEFAULT_SONNET_MODEL.
Q. Qual deve ser o padrão, o Opus 5.5 ou o Sonnet 5.5?
A. O ponto de partida oficial é o Opus 5.5. Se o seu foco é implementação com escopo claro, correção de bugs e criação de documentos, com effort de low a high, o Sonnet 5.5 sai pela metade do preço unitário de entrada e saída. Se for rodar em xhigh ou max, a diferença de custo diminui, como diz o anúncio, então compare os dois no seu próprio trabalho.
* Os números deste artigo se baseiam no anúncio oficial da Anthropic, "Introducing Claude Sonnet 5.5" (benchmarks conforme a tabela comparativa e as descrições dos gráficos da mesma página), na documentação oficial "Models overview", "Claude Sonnet 5.5", "What's new in Claude Sonnet 5.5", "Migrating to Claude Sonnet 5.5", "Pricing", "Thinking", "Effort" e "Prompt caching", em "Model configuration" e no CHANGELOG do Claude Code e no changelog do GitHub (todos verificados em 29 de setembro de 2026). Especificações e preços podem mudar, então faça a confirmação final na documentação oficial.
Artigos relacionados: Guia de lançamento do Claude Opus 5.5, Mudanças incompatíveis e migração no Claude Fable 5.1, Comparação de preços do Claude.