Índice
- 1. O essencial do Opus 5.5: desempenho, preço e riscos da migração
- 2. Especificações principais e onde está disponível
- 3. Preço: mais barato que o Opus 5, mas depende da comparação
- 4. Benchmarks: comparando apenas dentro da tabela da Anthropic
- 5. Onde ele não vence e como ler a tabela
- 6. O que significa o novo effort padrão medium
- 7. Quatro coisas que quebram ao sair do Opus 5, e como corrigir
- 8. Mudanças que acontecem sem nenhum erro
- 9. O que muda no Claude Code e no claude.ai
- 10. Como escolher entre Opus 5.5, Fable 5.1, Sonnet 5 e Opus 5
- 11. Passos da migração (para quem usa a API)
- Resumo
- FAQ
Em 22 de setembro de 2026, a Anthropic lançou o Claude Opus 5.5. O anúncio o apresenta como o primeiro modelo da família Claude 5.5, e ele chega apenas dois meses depois do Opus 5 (lançado em 24 de julho). Na visão geral de modelos da documentação oficial, ele passou a ser o ponto de partida recomendado para a maioria dos casos de uso quando você não sabe qual modelo escolher, e o Opus 5 foi para a categoria Legacy (mais antigo, mas ainda disponível).
Resumindo: o preço caiu em relação ao Opus 5 ($4 de entrada / $20 de saída, contra $5 / $25 do Opus 5). Só que o comportamento da API mudou bastante, e há quatro mudanças que transformam código que funcionava no Opus 5 em erros 400. Além disso, o effort padrão, usado quando você não especifica nenhum, caiu de high para medium. Quem troca de modelo só olhando o preço pode dar de cara com erros ou com uma mudança de qualidade que nem percebe. Este artigo confronta o texto original da documentação oficial com o do anúncio e mostra o que mudou, quanto custa e o que quebra na migração, na ordem em que você vai lidar com cada coisa.
Informações de 24 de setembro de 2026: escrito dois dias após o lançamento, depois da leitura do texto original da documentação da Claude Platform (visão geral de modelos, página do Opus 5.5, What's new, guia de migração e preços), do anúncio da Anthropic e da documentação e do CHANGELOG do Claude Code. O Claude Sonnet 5.5 e o Claude Haiku 5.5, que segundo o anúncio chegam nas próximas semanas, ainda não tinham sido lançados nessa data.
Corte de preço e quatro mudanças incompatíveis, tudo de uma vez
— Posicionado oficialmente como modelo para programação agêntica de longa duração e trabalho do conhecimento
1. O essencial do Opus 5.5: desempenho, preço e riscos da migração
Na tabela comparativa da Anthropic, ele registra pontuações acima do Fable 5.1 em programação agêntica, trabalho do conhecimento e uso do computador. O próprio anúncio o coloca no mesmo nível do Fable 5.1 na maior parte do trabalho. E o mesmo anúncio diz que, nesse patamar, as diferenças de benchmark já não são um guia confiável para as diferenças no uso real.
Entrada e saída ficam 20% mais baratas que no Opus 5, a $4 / $20, e a leitura de cache fica 60% mais barata, a $0,20. Já em relação ao Sonnet 5, entrada e saída custam o dobro, enquanto a leitura de cache custa o mesmo. O que “mais barato” significa depende da comparação.
São quatro: não dá para desligar o raciocínio / o uso forçado de ferramentas devolve 400 / os blocos de raciocínio ficam vinculados ao modelo e à conversa / a ferramenta antiga de computer use deixou de existir. Além disso, o effort padrão cai para medium, e o texto entre chamadas de ferramenta passa para blocos de raciocínio.
Em uma frase, o Opus 5.5 é “um Opus mais barato que se usa do mesmo jeito que o Fable 5.1”. Para três das quatro mudanças incompatíveis, a própria documentação oficial observa que elas também valem para o Claude Fable 5.1. Se o seu código já passou por uma migração para o Fable 5.1, sobra bem menos trabalho.
2. Especificações principais e onde está disponível
Vamos começar pelos números. A comparação inclui três modelos: o Opus 5, que ele substitui; o Fable 5.1, a camada acima; e o Sonnet 5, a camada abaixo.
| Item | Opus 5.5 | Opus 5 (Legacy) | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| ID do modelo na API | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
claude-sonnet-5 |
| Preço (entrada/saída) | $4 / $20 | $5 / $25 | $10 / $50 | $2 / $10 |
| Contexto / saída máxima | 1M / 128K | 1M / 128K | 1M / 128K | 1M / 128K |
| Raciocínio (thinking) | Sempre ligado (não pode ser desligado) | Ligado por padrão. Pode ser desligado com effort high ou abaixo | Sempre ligado (não pode ser desligado) | Ligado por padrão. Pode ser desligado em qualquer effort |
| Effort padrão | medium | high | high | high |
| Corte de conhecimento confiável | Junho de 2026 | Maio de 2026 | Junho de 2026 | Janeiro de 2026 |
| Velocidade (rótulo relativo oficial) | Moderada | — | Mais lenta | Rápida |
| Desativação | Não antes de 22 de setembro de 2027 | Não antes de 24 de julho de 2027 | Não antes de 1º de setembro de 2027 | Não antes de 30 de junho de 2027 |
Fontes: Anthropic, “Models overview”, “Claude Opus 5.5”, “Claude Opus 5”, “Migrating to Claude Opus 5.5” (consultadas em 24 de setembro de 2026). A velocidade é um rótulo relativo dentro da linha atual e não aparece para o Opus 5, que é Legacy. As datas de desativação são compromissos para as plataformas operadas pela Anthropic; Amazon Bedrock e Google Cloud definem as suas próprias.
O que chama a atenção na tabela é que só duas linhas, “Raciocínio” e “Effort padrão”, diferem do Opus 5. Contexto e saída máxima são idênticos, e o corte de conhecimento avançou apenas um mês. Na ficha técnica, o que o separa do Opus 5 é a forma de usar e o custo; a diferença de desempenho está na tabela da seção 4. Vale notar também que, na Message Batches API, adicionar o cabeçalho beta output-300k-2026-03-24 eleva o limite de saída para 300K tokens (igual ao Opus 5).
Plataformas
Claude API (claude-opus-5-5), Amazon Bedrock (anthropic.claude-opus-5-5), Claude Platform on AWS, Google Cloud e Microsoft Foundry. Chegou a todas as plataformas no primeiro dia.
claude.ai, os apps para iOS e Android e o Claude Code. No Claude Code, ele virou o modelo padrão nos principais planos, incluindo o Pro, a partir da v2.1.280 (seção 9).
A variante mais rápida é uma prévia de pesquisa, e a documentação oficial a lista como exclusiva da Claude API. Não está disponível no Bedrock, na Claude Platform on AWS, no Google Cloud nem no Microsoft Foundry.
3. Preço: mais barato que o Opus 5, mas depende da comparação
A página oficial What's new informa o preço de $4 / $20, abaixo dos $5 / $25 do Opus 5. É a primeira mudança no preço do Opus depois que $5 / $25 se manteve do Opus 4.5 até o Opus 5 (confirmado na tabela da página oficial de preços). Veja os valores detalhados.
| Por milhão de tokens | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| Entrada | $4 | $5 | $10 | $2 |
| Saída | $20 | $25 | $50 | $10 |
| Escrita de cache (5 min) | $5 | $6,25 | $12,50 | $2,50 |
| Escrita de cache (1 hora) | $8 | $10 | $20 | $4 |
| Leitura de cache | $0,20 5% da entrada |
$0,50 10% da entrada |
$0,25 2,5% da entrada |
$0,20 10% da entrada |
| Batch API (entrada/saída) | $2 / $10 | $2,50 / $12,50 | $5 / $25 | $1 / $5 |
| Modo rápido (entrada/saída) | $8 / $40 | $10 / $50 | — | — |
Fonte: Anthropic, “Pricing” (consultada em 24 de setembro de 2026). A linha do modo rápido cobre apenas os modelos que constam na tabela de modo rápido da página de preços. Os $2 / $10 do Sonnet 5 foram apresentados no lançamento como preço promocional até 31 de agosto e depois se tornaram o preço padrão (segundo uma nota na mesma página).
“Mais barato” significa coisas diferentes para cada modelo
Em relação ao Opus 5, ele é mais barato em todos os itens. Já contra o Fable 5.1 ou o Sonnet 5, a diferença não se distribui igualmente entre os itens. O gráfico abaixo mostra o valor do Opus 5.5 quando o preço do outro modelo é fixado em 100.
Valor do Opus 5.5 quando o preço do outro modelo = 100
Fonte: cálculo deste artigo a partir dos valores de “Pricing” da Anthropic (o comprimento das barras usa 200 como largura total)
Três conclusões:
- Vindo do Opus 5, quanto mais a carga de trabalho depende de cache, mais você economiza. Entrada e saída têm 20% de desconto, e a leitura de cache, 60%. O próprio anúncio lembra que a leitura de cache responde pela maior parte do custo em trabalho agêntico e de programação.
- Contra o Fable 5.1, a diferença na leitura de cache é pequena. Entrada e saída custam 40% do preço do Fable 5.1, mas a leitura de cache fica em $0,20 contra $0,25, uma diferença de só 20%.
- Contra o Sonnet 5, só a leitura de cache custa o mesmo. Entrada e saída são duas vezes mais caras, mas a leitura de cache é $0,20 nos dois, então a diferença de preço diminui conforme cresce a fatia de tokens em cache.
Exemplo prático: uma tarefa com 10M de tokens de leitura de cache, 500K de entrada e 300K de saída (as quantidades de tokens são uma suposição deste artigo; o custo de escrita de cache fica de fora)
- Opus 5.5: $2,00 + $2,00 + $6,00 = $10,00
- Opus 5: $5,00 + $2,50 + $7,50 = $15,00 (o Opus 5.5 custa dois terços disso)
- Fable 5.1: $2,50 + $5,00 + $15,00 = $22,50
- Sonnet 5: $2,00 + $1,00 + $3,00 = $6,00 (o Opus 5.5 custa cerca de 1,7 vez, não 2 vezes)
A comparação usa quantidades de tokens idênticas; na prática, cada modelo consome uma quantidade diferente. Valores de “Pricing” da Anthropic.
Mais um ponto: o preço por token e a conta final são coisas diferentes. O anúncio da Anthropic diz que, nas configurações padrão, ele custa 40% menos que o Opus 5 em trabalhos típicos, porque o preço por token é menor e ele também usa menos tokens por tarefa. Essa é uma medição da própria Anthropic. Por outro lado, a documentação oficial também diz que, no mesmo effort, o Opus 5.5 tende a raciocinar mais por turno que o Opus 5, sobretudo em xhigh e max. Os tokens de raciocínio são cobrados como tokens de saída mesmo quando não aparecem. Cargas que rodavam barato no Opus 5 com o raciocínio desligado não podem desligá-lo no Opus 5.5, então os tokens de saída podem aumentar. Depois de migrar, a única forma de saber é medir o usage e comparar de novo com a sua própria carga de trabalho. Os preços de todos os modelos Claude estão reunidos no nosso comparativo de preços de Opus, Sonnet e Haiku.
4. Benchmarks: comparando apenas dentro da tabela da Anthropic
O anúncio do Opus 5 mostrava a tabela comparativa como imagem, mas este anúncio usa uma tabela em texto na própria página. Ela tem cinco colunas: Opus 5.5, Fable 5.1, Opus 5, GPT-6 Astra e GPT-5.6 Sol. Primeiro, as condições da tabela:
- Salvo indicação em contrário, o Opus 5.5 foi medido no effort máximo (max). A única exceção é o Terminal-Bench 4.0: Opus 5.5 em xhigh e GPT-6 Astra em high (valor informado pela OpenAI), a melhor pontuação de cada modelo
- Os valores do GPT-6 Astra e do GPT-5.6 Sol no Terminal-Bench 4.0, e do GPT-6 Astra no Terminal-Bench-Science 0.1, foram informados pela OpenAI. Para os valores dos GPT nas outras linhas, não há nota sobre quem fez a medição
- Os valores do AutomationBench foram medidos e divulgados pela Zapier (o Opus 5.5 vem da avaliação de acesso antecipado da Zapier; o Opus 5 e os dois GPT, do ranking público da Zapier). É a única linha que a tabela identifica explicitamente como medida por terceiros
- O Opus 5.5 foi medido com as mesmas salvaguardas ativas em produção. Nos problemas em que uma salvaguarda interveio, quem resolveu no lugar dele foi o Opus 4.8, em cibersegurança, e o Opus 5, em biologia e desenvolvimento de LLMs de fronteira. A Anthropic observa que isso provavelmente reduz as pontuações do Opus 5.5
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 Programação agêntica no terminal |
66,4% | 55,8% | 52,3% | 57,9% | 37,3% |
| FrontierCode v1.1 (Main) Se as alterações são aceitas no merge |
54,4% | 50,3% | 48,0% | 53,3% | 47,5% |
| CursorBench 4.0 Tarefas ambíguas em vários arquivos |
57,8% | 51,8% | 46,6% | — | 41,7% |
| GDPval-AA v2.1 (Elo) Trabalho real em 44 ocupações |
1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench Fluxos de trabalho empresariais (medido pela Zapier) |
40,0% | 31,4% | 26,9% | 41,4% | 28,8% |
| Humanity's Last Exam Raciocínio entre áreas (com ferramentas) |
67,7% | 65,6% | 63,6% | 57,2% | — |
| Terminal-Bench-Science 0.1 Pesquisa científica agêntica |
58,7% | 52,6% | 29,0% | 64,6% | 22,4% |
| OSWorld 2.0 Uso do computador (marcado como parcial na tabela) |
81,8% | 80,7% | 74,0% | — | — |
| Chartography Leitura de gráficos (com ferramentas) |
89,0% | 88,4% | 83,4% | — | — |
Fonte: tabela comparativa de “Introducing Claude Opus 5.5”, da Anthropic (22 de setembro de 2026; consultada em 24 de setembro). Verde indica que o Opus 5.5 tem a maior pontuação da linha; vermelho indica que a mesma tabela traz uma pontuação maior que a do Opus 5.5 naquela linha. “—” indica que a tabela não traz valor.
O Opus 5.5 tem a maior pontuação em 7 das 9 linhas. As maiores vantagens estão no Terminal-Bench 4.0 (10,6 pontos à frente do Fable 5.1) e no GDPval-AA v2.1 (111 pontos à frente do Fable 5.1). Em relação ao Opus 5 anterior, o Terminal-Bench-Science 0.1 passou de 29,0% para 58,7%, praticamente o dobro.
Pontuações por nível de effort, segundo as descrições dos gráficos do anúncio
Os valores da tabela são em max (xhigh no Terminal-Bench 4.0), mas o anúncio também traz gráficos que cruzam pontuação e custo por tarefa em cada nível de effort, e as descrições desses gráficos informam valores no medium padrão.
54,6% em medium. Supera a melhor pontuação do GPT-6 Astra (53,3%) com cerca de um quinto do custo por tarefa. A pontuação em medium é maior que a de max na tabela (54,4%).
52,5% em medium. Fica acima do Fable 5.1 (max), com 51,8%, e do Opus 5 (max), com 46,6%, e supera em 11 pontos a melhor pontuação do GPT-5.6 Sol (41,7%) com cerca de um terço do custo.
No effort padrão, supera o Opus 5 em max com cerca de um quinto do custo. Empata com o GPT-6 Astra com aproximadamente 40% do custo.
Em medium, supera o GPT-6 Astra em max com cerca de um quinto do custo por tarefa.
Fonte: descrições dos gráficos de “Introducing Claude Opus 5.5”, da Anthropic (todas as medições e comparações são da própria Anthropic)
O FrontierCode merece atenção. No mesmo anúncio, medium (54,6%) supera ligeiramente max (54,4%). O padrão visto desde o Opus 5, em que aumentar o effort nem sempre aumenta a pontuação, continua no Opus 5.5 (seção 6). Para o anúncio e os números do próprio GPT-6 Astra, veja nossa análise do lançamento do GPT-6 Astra.
5. Onde ele não vence e como ler a tabela
A cobertura de lançamentos costuma listar só as linhas em que o modelo vence, então aqui vai o outro lado. Tudo o que segue vem do próprio anúncio e da documentação da Anthropic.
Na própria tabela da Anthropic, o GPT-6 Astra fica à frente no AutomationBench, 40,0% contra 41,4%, e no Terminal-Bench-Science 0.1, 58,7% contra 64,6%. Observe que o AutomationBench foi executado sem modelo de fallback, e as intervenções das salvaguardas contaram como falhas (segundo a nota da tabela).
Citando capacidades cibernéticas muito fortes, o anúncio diz que aplica salvaguardas próximas às do Fable 5.1 e encaminha a maior parte do trabalho de cibersegurança para o Opus 4.8. Encontrar e corrigir bugs no desenvolvimento do dia a dia continua funcionando normalmente.
A biologia recebe as mesmas salvaguardas do Fable 5.1. Para usá-lo em pesquisa e desenvolvimento, é preciso se inscrever no Life Sciences Verification Program, voltado a organizações verificadas.
Dois cuidados ao ler a tabela: primeiro, o próprio anúncio diz que, nesse nível de desempenho, as diferenças de benchmark estão deixando de ser um guia confiável para as diferenças no uso real, e que no uso interno da Anthropic a distância para o Fable 5.1 parece menor do que os números sugerem. Melhor não ler “10 pontos à frente do Fable 5.1” como 10 pontos de diferença na prática. Segundo, as versões dos testes diferem das usadas na tabela do anúncio do Opus 5 (CursorBench 3.2 → 4.0, GDPval-AA v2 → v2.1 etc.). Se você pegar números da tabela de julho e desta e colocar lado a lado, estará comparando valores medidos em condições diferentes.
6. O que significa o novo effort padrão medium
Esta é a mudança com mais chance de passar despercebida. Uma requisição que não especifica effort roda em high no Opus 5 e em medium no Opus 5.5. Com exatamente o mesmo código, o modelo raciocina um nível menos a fundo.
A página oficial sobre effort diz que definir explicitamente o padrão (medium no Opus 5.5) se comporta exatamente como omitir o effort. Se você quer a mesma profundidade do Opus 5, defina high explicitamente.
No mesmo effort, o Opus 5.5 tende a raciocinar mais por turno que o Opus 5, sobretudo em xhigh e max (What's new). Levar o high do Opus 5 para cá não garante o mesmo resultado.
Como o raciocínio não pode ser desligado, o effort é a única coisa que altera quanto o modelo raciocina e quanto ele custa. Onde você desligava o raciocínio no Opus 5, reduza o effort.
Então, qual nível usar? Veja as orientações da documentação oficial, resumidas para o Opus 5.5.
| effort | Indicado para (descrição oficial) | Observações para o Opus 5.5 |
|---|---|---|
| low | Tarefas simples em que velocidade e custo vêm primeiro, como subagentes | Candidato a substituir as cargas que desligavam o raciocínio no Opus 5 |
| medium (padrão) | Trabalho agêntico que precisa equilibrar velocidade, custo e desempenho | O nível que superou as melhores pontuações dos concorrentes no FrontierCode e no CursorBench nos gráficos do anúncio |
| high | Raciocínio complexo, programação difícil e trabalho agêntico | O padrão do Opus 5. Uma boa base de comparação logo após a migração |
| xhigh | Programação agêntica de longa duração | Comece com max_tokens em 64K tokens e ajuste a partir daí (guia de migração) |
| max | Problemas difíceis que exigem o raciocínio mais profundo | A documentação do Claude Code alerta que os ganhos tendem a estagnar e que ele é propenso a raciocinar demais, então teste antes de usar em larga escala |
Fontes: Anthropic, “Effort”, o guia de migração, Claude Code, “Model configuration”
A orientação oficial é coerente: não leve as configurações do modelo anterior; reajuste o effort com o seu próprio conjunto de avaliação. O anúncio também cita empresas que testaram o modelo antes do lançamento, como a Deloitte, que relatou que mesmo no effort mais baixo ele encontrou mais bugs conhecidos que o Opus 5 em high. Mas esses são resultados que cada empresa mediu no próprio trabalho e que a Anthropic escolheu publicar; não há garantia de que a sua carga se comporte da mesma forma. Verifique no seu próprio trabalho se o medium sustenta a qualidade e o que melhora quando você sobe para high. No Opus 5.5, também é possível mudar o effort a cada mensagem no meio da conversa sem quebrar o cache do prompt (beta).
7. Quatro coisas que quebram ao sair do Opus 5, e como corrigir
A página oficial What's new in Claude Opus 5.5 lista quatro mudanças incompatíveis que afetam código rodando no Opus 5. Todas devolvem um 400 invalid_request_error.
① Não dá para desligar o raciocínio
O Opus 5 aceitava thinking: {"type": "disabled"} com effort high ou abaixo. No Opus 5.5, o raciocínio fica sempre ligado, e tanto disabled quanto um orçamento manual, {"type": "enabled", "budget_tokens": N}, devolvem erro em qualquer nível de effort. A mensagem que volta é:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
Correção: remova o parâmetro thinking (ele passa a ser tratado como {"type": "adaptive"}). Onde você desligava o raciocínio para economizar, reduza o effort.
# Antes: funciona no Opus 5, devolve 400 no Opus 5.5 client.messages.create( model="claude-opus-5", max_tokens=16000, thinking={"type": "disabled"}, messages=[...], ) # Depois: o raciocínio fica sempre ligado; o effort define quanto client.messages.create( model="claude-opus-5-5", max_tokens=16000, output_config={"effort": "low"}, messages=[...], )
Como o raciocínio sempre roda, uma resposta pode começar com um bloco de raciocínio. Código que lê por posição, como content[0].text, vai quebrar; selecione os blocos cujo type é "text". Em loops de uso de ferramentas, devolva os blocos de raciocínio intactos, mesmo quando estiverem vazios (editar, reordenar ou descartar algum deles devolve 400). O max_tokens limita raciocínio e resposta somados, então as cargas que tinham o raciocínio desligado precisam rever esse limite.
② O uso forçado de ferramentas devolve erro
Definir tool_choice como {"type": "any"} ou {"type": "tool", "name": "..."} devolve 400. A API de contagem de tokens aplica a mesma verificação. Só auto (o padrão) e none são permitidos.
tool_choice: type "tool" and "any" are not supported for this model.
Correção: mantenha tool_choice em auto e adicione strict: true às definições das ferramentas (strict tool use), ou mova o schema para structured outputs. Depois, diga no prompt quando a ferramenta deve ser usada. Se você usava o uso forçado de ferramentas só para garantir saída em JSON, migrar para structured outputs é o caminho mais limpo. Um cuidado: o strict tool use aceita apenas um subconjunto do JSON Schema, e todo objeto do schema precisa de additionalProperties: false.
# Depois: auto + strict; diga em palavras quando usar a ferramenta client.messages.create( model="claude-opus-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "Qual é o clima em Paris? Use a ferramenta get_weather."}], )
③ Os blocos de raciocínio ficam vinculados ao modelo e à conversa
Cada bloco de raciocínio registra qual modelo o gerou. O Opus 5.5 consegue ler blocos de raciocínio dos modelos Opus, Sonnet e Haiku até o Opus 5, mas não os do Fable nem do Mythos. No sentido inverso, só o Fable 5.1 e o Mythos 5.1 na Claude API conseguem ler os blocos de raciocínio do Opus 5.5.
- Trocar Opus 5 → Opus 5.5, ou Opus 5.5 → Fable 5.1 (Claude API) leva o raciocínio anterior junto
- Qualquer outra troca (por exemplo, Opus 5.5 → Sonnet 5) faz os turnos seguintes rodarem sem o raciocínio do modelo anterior. A requisição em si funciona, e os blocos descartados não são cobrados
Além disso, a API verifica se nada antes de um bloco de raciocínio do Opus 5.5 (system, tools, mensagens anteriores) mudou desde que o bloco foi criado. Em contas criadas a partir de 31 de agosto de 2026, 00:00 (UTC), isso é aplicado por padrão, e enviar blocos sobre um histórico que você reescreveu no meio da conversa devolve 400.
Correção: avance a conversa apenas acrescentando. Quando quiser mudar instruções ou ferramentas, use uma mensagem de sistema no meio da conversa em vez de reescrever o histórico. Segundo o guia de migração, o Claude Code, o claude.ai, os Claude Managed Agents e o Claude Agent SDK já funcionam só acrescentando, então se você constrói sobre eles, não há nada a mudar. Se não der para evitar a reescrita, adicione o cabeçalho beta thinking-binding-controls-2026-08-01 e defina thinking.block_binding.prefix_mismatch_behavior como "drop_block" para que os blocos afetados sejam descartados em vez de gerar erro. O mecanismo é o mesmo do Fable 5.1, que explicamos em detalhes no nosso artigo sobre as mudanças incompatíveis do Fable 5.1.
④ A ferramenta antiga de computer use não está disponível na Claude API nem no Google Cloud
O Opus 5 aceitava computer use tanto pelo novo conjunto de ferramentas computer_toolset_20260801 quanto pela ferramenta antiga computer_20251124 com cabeçalho beta. O Opus 5.5 na Claude API e no Google Cloud aceita apenas o conjunto de ferramentas, e declarar a ferramenta antiga devolve 400. A mensagem começa assim:
'claude-opus-5-5' does not support tool types: computer_20251124.
Correção: remova o cabeçalho beta e substitua tools por [{"type": "computer_toolset_20260801"}] (sem nome e sem tamanho de tela). O loop do agente também precisa mudar, em três pontos: o tipo de ação fica no name do bloco, não em input.action; um único turno pode conter várias ações; e todo resultado precisa ser devolvido com toolset_name. No Amazon Bedrock, a ferramenta antiga continua funcionando com o Opus 5.5, então lá não é preciso mudar nada.
8. Mudanças que acontecem sem nenhum erro
As quatro mudanças incompatíveis devolvem 400, então você vai notá-las. As traiçoeiras são as mudanças em que só o comportamento muda, sem erro algum.
| Mudança | O que acontece / o que fazer |
|---|---|
| O texto entre chamadas de ferramenta vai para blocos de raciocínio | Frases curtas como “agora vou verificar X”, que eram blocos de texto no Opus 5, agora voltam como blocos de raciocínio de progresso. Na configuração de exibição padrão (display: "omitted") eles vêm vazios, então interfaces que mostravam o progresso ao usuário ficam em silêncio entre as chamadas de ferramenta. Defina display como "updates" (beta, cabeçalho thinking-display-updates-2026-08-18; devolve só o progresso e mantém o raciocínio oculto) ou "summarized" (devolve resumos do raciocínio misturados ao progresso), e mostre os blocos de raciocínio não vazios antes do tool_use que vem em seguida |
| Mais categorias de recusa | Um classificador de biologia agora roda junto com o de cibersegurança, e pedidos que tentam fazer o modelo escrever o raciocínio interno na resposta podem ser recusados como reasoning_extraction. A recusa volta como HTTP 200 com stop_reason: "refusal", então leia stop_details para tratá-la. O fallback do lado do servidor (fallbacks: "default", beta) não tenta de novo em caso de reasoning_extraction |
| Leitura de gráficos e figuras mais precisa | Agora ele lê com precisão imagens com gráficos detalhados ou conteúdo que depende do layout, mesmo sem ferramentas. Os contornos de prompt que você criou para modelos antigos talvez não sejam mais necessários (embora adicionar ferramentas ainda melhore a precisão nas entradas mais detalhadas) |
| Vindo do Opus 4.8: sem Priority Tier | O Opus 4.8 é compatível com o Priority Tier, mas o Opus 5.5 não. Organizações com contrato precisam planejar a capacidade separadamente |
Fontes: What's new in Claude Opus 5.5, Migrating to Claude Opus 5.5
9. O que muda no Claude Code e no claude.ai
Esta é a parte que importa se você não chama a API diretamente. O Claude Code passou a dar suporte ao Opus 5.5 na v2.1.280 do CHANGELOG.
default agora significa Opus 5.5 no Pro, Max, Team, Enterprise e na API. O Pro e o Team Standard usavam o Sonnet 5 como padrão, então para eles é uma troca de Sonnet para Opus. O alias opus também aponta para o Opus 5.5 na Claude API, na Claude Platform on AWS, no Bedrock e no Google Cloud. Versões anteriores à v2.1.280 não conseguem usá-lo, então rode claude update.
O Opus 5.5 começa em medium. O nível de effort que você salvou com /effort na época do Opus 5 não é herdado (nem a configuração salva por modelo nem o antigo effortLevel de nível superior nas configurações de usuário valem para o Opus 5.5). Ele roda em medium até você escolher de novo em /effort ou na tela /model. A variável de ambiente CLAUDE_CODE_EFFORT_LEVEL e um effortLevel definido nas configurações de projeto ou gerenciadas valem para todos os modelos.
Alt+T (Option+T no macOS), alwaysThinkingEnabled e MAX_THINKING_TOKENS=0 não têm efeito no Opus 5.5 nem no Fable. A partir da v2.1.281, nos modelos em que o raciocínio não pode ser desligado, o Claude Code mostra uma explicação de uma linha em vez de alternar a opção.
Quando um classificador dispara, pedidos de biologia são executados de novo no Opus 5 e os de cibersegurança no Opus 4.8, e a sessão continua nesse modelo. Use /model para voltar. A documentação oficial diz que, em testes de invasão, CTFs ou bases de código com muita biologia, isso costuma acontecer já no primeiro pedido.
Fontes: Claude Code, “Model configuration” e o CHANGELOG (v2.1.280 e v2.1.281, consultados em 24 de setembro de 2026)
Como o Claude Code guarda o effort está explicado no nosso guia da configuração de effort, e o funcionamento do raciocínio em si está em adaptive thinking vs. extended thinking. Segundo o anúncio da Anthropic, o modo rápido (até 2,5 vezes mais rápido, $8 de entrada / $40 de saída) também está disponível no Claude Code.
claude.ai e os apps
O Opus 5.5 pode ser escolhido no claude.ai e nos apps para iOS e Android desde o dia do lançamento (a Anthropic publicou um system prompt do Opus 5.5 com a mesma data). O anúncio também diz que, junto com o corte de preço, vai aumentar os limites de uso de cinco horas do Pro, Max, Team e Enterprise por assento e dar aos assinantes um reset do limite de uso para usar quando quiserem. O anúncio não informa em quanto os limites aumentam. Os preços por plano estão no nosso comparativo de preços entre Claude e ChatGPT.
10. Como escolher entre Opus 5.5, Fable 5.1, Sonnet 5 e Opus 5
A orientação da visão geral oficial de modelos é curta: na dúvida, comece pelo Opus 5.5; use o Fable 5.1 para raciocínio exigente e trabalho agêntico de longa duração, ou quando o Opus 5.5 ainda não for suficiente depois de avaliado em effort high. Somando preço e restrições da API, a escolha fica assim.
- Você quer definir primeiro um modelo só (o ponto de partida oficial)
- Programação agêntica de longa duração e trabalho do conhecimento
- Você está no Opus 5 (mais barato em todos os valores)
- O custo do Fable 5.1 pesa e você quer testar se o Opus 5.5 basta
- A qualidade ainda não basta depois de avaliar o Opus 5.5 em high ou acima
- Raciocínio exigente, trabalho agêntico muito longo
- Em trabalho com muito cache, a diferença de preço é menor que na entrada/saída ($0,25 contra $0,20)
- Você precisa de velocidade ou alto volume (rótulo oficial de velocidade: Rápida)
- Você quer desligar o raciocínio ou continuar usando o uso forçado de ferramentas
- Entrada e saída custam metade do Opus 5.5 (a leitura de cache custa o mesmo)
- O sucessor, Sonnet 5.5, foi anunciado para as próximas semanas
- Como solução provisória até corrigir os quatro pontos da seção 7
- É Legacy, mas continua disponível, com desativação não antes de 24 de julho de 2027
- Todos os valores são mais altos que os do Opus 5.5, então há pouco motivo para ficar muito tempo
Na dúvida, a ordem é simples: ① rode o Opus 5.5 em medium e em high no seu próprio trabalho → ② se não bastar, teste xhigh → ③ se ainda não bastar, passe para o Fable 5.1 → e, se medium se mostrar mais que suficiente, veja se low ou o Sonnet 5 também dão conta. Subir o effort e subir de modelo são duas formas de pagar por qualidade, e qual delas rende mais pelo mesmo ganho depende do trabalho.
11. Passos da migração (para quem usa a API)
Do checklist do guia de migração, estes são os itens que valem para quem sai do Opus 5, na ordem em que você os faria. O Claude Code também tem o /claude-api migrate para ajudar nisso (uma skill incluída, mencionada no guia de migração; ela confirma o escopo com você antes de editar).
- Troque o ID do modelo de
claude-opus-5paraclaude-opus-5-5(anthropic.claude-opus-5-5no Bedrock) - Remova
disabledeenabled(com orçamento) dethinkinge escolha um effort no lugar - Defina o effort explicitamente (omitir significa medium; use
highpara ter a mesma profundidade do Opus 5) - Substitua
anyetoolemtool_choiceporautocom strict tool use, ou por structured outputs - Se usa computer use na Claude API ou no Google Cloud, migre para
computer_toolset_20260801e ajuste o loop - Leia as respostas selecionando os blocos por
typee, nos loops de ferramentas, devolva os blocos de raciocínio intactos - Se você mostra progresso numa interface, defina
displaycomo"updates"ou"summarized" - Se você reescreve
system,toolsou mensagens anteriores no meio da conversa, mude para um padrão de só acrescentar - Se você encaminha requisições para outros modelos, teste partindo do princípio de que o raciocínio do Opus 5.5 não será levado adiante
- Trate
stop_reason: "refusal"e configure fallbacks - Revise o
max_tokensdas cargas que tinham o raciocínio desligado (comece em 64K para xhigh e max) - Meça de novo custo e latência no effort escolhido
Fonte: itens da seção “Every starting model” de Anthropic, “Migrating to Claude Opus 5.5”, reordenados na ordem de trabalho
Se você vem direto do Opus 4.8 ou anterior, também precisa lidar com o raciocínio passando a rodar em requisições que nunca o especificaram. Vale conferir também os passos de migração da nossa análise do lançamento do Opus 5.
Resumo
O Claude Opus 5.5 é um lançamento em que um corte de preço e uma mudança na forma de usar o modelo chegaram juntos. Os valores caíram 20% na entrada e na saída e 60% na leitura de cache, e na própria tabela comparativa da Anthropic ele supera o Fable 5.1 em muitas linhas. Por outro lado, o raciocínio não pode mais ser desligado, e o uso forçado de ferramentas, a ferramenta antiga de computer use e a reescrita do histórico agora causam erros 400.
E a queda do effort padrão para medium passa facilmente despercebida justamente porque não gera erro. Na API, defina o effort explicitamente; no Claude Code, confira se as suas configurações do Opus 5 não deixaram de valer em silêncio. Se ficou mesmo mais barato é algo para medir com o usage, e não pelo preço por token.
Por fim, os números de benchmark são valores medidos naquela tabela, naquelas condições. No AutomationBench e no Terminal-Bench-Science, o GPT-6 Astra aparece acima na mesma tabela, e a própria Anthropic diz que a distância para o Fable 5.1 é menor do que os números sugerem. Comece comparando medium e high no seu próprio trabalho.
FAQ
P. O Opus 5.5 é mais barato que o Opus 5?
R. Os preços por token são menores em todos os itens ($4 de entrada, $20 de saída e $0,20 de leitura de cache, contra $5, $25 e $0,50 do Opus 5). A Anthropic diz que ele é 40% mais barato em trabalhos típicos nas configurações padrão, mas essa é uma medição dela. Cargas que rodavam com o raciocínio desligado podem gerar mais tokens de saída, então confira o usage depois de migrar.
P. Existe alguma forma de desligar o raciocínio?
R. Não. Na API, enviar disabled devolve 400, e o Alt+T do Claude Code e configurações semelhantes não têm efeito. Para reduzir quanto ele raciocina, defina o effort como low. Se você realmente precisa do raciocínio desligado, a opção é o Sonnet 5, que permite desligá-lo em qualquer effort.
P. Troquei o ID do modelo e agora recebo erro 400.
R. A mensagem de erro diz qual é o caso. "thinking.type.disabled" ou "thinking.type.enabled" apontam para a configuração de raciocínio, tool_choice: type "tool" and "any" para o uso forçado de ferramentas, e computer_20251124 para a ferramenta antiga de computer use. Se não for nenhum desses e você reescreve o histórico no meio da conversa, suspeite da verificação dos blocos de raciocínio (seção 7, ③).
P. No Claude Code, minha configuração de effort do Opus 5 parece não valer.
R. É proposital. O effort salvo com /effort é guardado por modelo, e nem a configuração do Opus 5 nem o antigo effortLevel de nível superior nas configurações de usuário valem para o Opus 5.5. O Opus 5.5 começa em medium. Escolha de novo com /effort e ele fica salvo como configuração do Opus 5.5.
P. Meu agente personalizado parou de mostrar o progresso enquanto trabalha.
R. No Opus 5.5, o texto entre chamadas de ferramenta volta em blocos de raciocínio, que ficam vazios na configuração de exibição padrão. Defina thinking.display como "updates" (beta) ou "summarized" e mostre os blocos de raciocínio não vazios.
* Os números deste artigo se baseiam no anúncio oficial da Anthropic, “Introducing Claude Opus 5.5” (benchmarks da tabela comparativa e das descrições dos gráficos dessa página), na documentação oficial “Models overview”, “Claude Opus 5.5”, “What's new in Claude Opus 5.5”, “Migrating to Claude Opus 5.5” e “Pricing”, e na “Model configuration” e no CHANGELOG do Claude Code (todos consultados em 24 de setembro de 2026). Especificações e preços podem mudar, então confirme os detalhes finais na documentação oficial.
Artigos relacionados: análise do lançamento do Claude Opus 5, mudanças incompatíveis e migração do Claude Fable 5.1.