O Claude Opus 5.5 é o novo modelo de topo da Anthropic, lançado em 22 de setembro de 2026. Ele custa 4 dólares por milhão de tokens de entrada e 20 de saída, roda cerca de 40% mais barato que o Opus 5 e lidera o Terminal-Bench 4.0 com 66,4%, acima do Fable 5.1.

Na prática, o comunicado que circulou na imprensa parou no preço. Portanto, vale começar pelo que ficou de fora: a atualização traz quatro mudanças incompatíveis na API e trocou o modelo padrão do Claude Code sem avisar ninguém. Na prática, quem mantém agente em produção pode ver o comportamento mudar hoje sem ter tocado numa linha de código.

O que é o Claude Opus 5.5 e o que mudou?

O Claude Opus 5.5 abre a família 5.5 da Anthropic e foi desenhado, sobretudo, para agentes de código que rodam por horas. De fato, a documentação oficial descreve o posicionamento dele como “para coding agêntico de longa duração e trabalho de conhecimento”, e recomenda começar por ele na maioria das cargas. Por outro lado, a própria Anthropic sugere manter o Fable 5.1 em raciocínio muito exigente ou horizonte extremamente longo.

Na prática, o identificador é claude-opus-5-5 na Claude API, no Google Cloud e no Microsoft Foundry, e anthropic.claude-opus-5-5 no Amazon Bedrock. Além disso, a janela de contexto segue em 1 milhão de tokens, com saída máxima de 128 mil e corte de conhecimento em junho de 2026. Inclusive, a aposentadoria do modelo só acontece a partir de 22 de setembro de 2027, o que dá previsibilidade a quem depende de engenharia de contexto bem calibrada.

Sonnet 5.5 e Haiku 5.5, por sua vez, foram anunciados para as próximas semanas. Logo, quem usa os modelos menores como camada barata de triagem ainda vai conviver com gerações misturadas por um tempo.

Quanto custa o Claude Opus 5.5 na API?

Primeiro, o Claude Opus 5.5 custa 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída. Por outro lado, o Opus 5 cobrava 5 e 25 dólares, ou seja, a tabela por token caiu 20%. Além disso, a leitura de cache despencou para 0,20 dólar por milhão, 60% abaixo do anterior e equivalente a 5% do preço de entrada. Na prática, a escrita de cache fica em 5 dólares na janela de 5 minutos e 8 dólares na de 1 hora, enquanto o processamento em lote sai pela metade: 2 e 10 dólares.

De fato, segundo a Anthropic, a economia real chega a 40% em cargas típicas, e ela vem de três vetores somados: preço por token 20% menor, leitura de cache 60% mais barata e menos tokens consumidos por tarefa. Consequentemente, quem já usa cache agressivo tende a capturar bem mais do que os 20% óbvios da tabela.

Por fim, existe ainda o fast mode, em research preview apenas na Claude API, atrás do beta header fast-mode-2026-02-01. Ele cobra 8 e 40 dólares e entrega, assim, até 2,5 vezes mais velocidade. Contudo, o recurso não está disponível no Bedrock, no Google Cloud nem no Foundry, o que inviabiliza depender dele em stack multicloud.

Publicidade

Opus 5 vs Opus 5.5: o que os benchmarks mostram?

O Claude Opus 5.5 lidera, de fato, todos os benchmarks divulgados pela Anthropic, com a maior folga em terminal e código agêntico. Veja a seguir os números oficiais lado a lado com o Claude Fable 5.1 e com a geração anterior.

BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066,4%55,8%52,3%57,9%
FrontierCode v1.154,4%50,3%48,0%53,3%
CursorBench 4.057,8%51,8%46,6%n/d
OSWorld 2.0 (computer use)81,8%80,7%74,0%n/d
Humanity’s Last Exam67,7%65,6%63,6%n/d
GDPval-AA v2.1 (Elo)184617351708n/d
Preço por milhão (entrada/saída)US$ 4 / US$ 20US$ 10 / US$ 50US$ 5 / US$ 25n/d

O detalhe que muda a decisão de arquitetura está na coluna de preço. Na prática, em esforço médio, o modelo marca 54,4% no FrontierCode por cerca de um quinto do custo do GPT-6 Astra, que fica em 53,3%. Da mesma forma, ele empata com o Astra no Terminal-Bench por volta de 40% do custo e supera o GPT-5.6 Sol em 11 pontos no CursorBench pagando perto de um terço. Inclusive, a geração de saída ficou mais de 30% mais rápida que a do Opus 5.

Inclusive, entre os relatos de quem recebeu acesso antecipado, a Anthropic cita uma migração de 680 mil linhas concluída em menos de 24 horas e uma auditoria de uma base de 200 mil linhas em menos de 3 horas, tarefa que levava mais de 20 horas no Opus 5. Contudo, são números da fabricante, não verificações independentes. De fato, o salto no Terminal-Bench é consistente com esse tipo de ganho em tarefa longa, principalmente quando o fluxo envolve criar subagents no Claude Code para dividir o trabalho.

Publicidade

O que quebra no seu código com o Claude Opus 5.5?

De fato, quatro chamadas que funcionavam no Opus 5 agora retornam erro 400 no Claude Opus 5.5. Portanto, essa é a parte da migração que exige leitura antes de trocar a string do modelo.

Checklist de incompatibilidades:

  • Thinking não desliga mais. Enviar thinking: {"type":"disabled"} ou budget manual devolve invalid_request_error. Assim, omita o campo ou use {"type":"adaptive"}.
  • Forced tool use saiu. tool_choice com any ou nome fixo retorna 400, inclusive na contagem de tokens. Logo, use auto com strict tool use ou structured outputs.
  • Thinking blocks ficaram atrelados ao modelo e à conversa. Além disso, blocos de Fable e Mythos não são lidos, e alterar system prompt, tools ou mensagens anteriores invalida o replay.
  • Computer use trocou de toolset.computer_toolset_20260801 é aceito na Claude API e no Google Cloud. Por outro lado, no Bedrock a ferramenta antiga continua funcionando.

Na prática, o controle de raciocínio migrou para o parâmetro effort, cujo padrão caiu de high para medium. Além disso, o modelo pensa mais por turno no mesmo nível de esforço, sobretudo em xhigh e max. Logo, refazer o sweep de effort e deixar folga no max_tokens evita truncamento silencioso na primeira semana.

Há ainda uma quinta mudança que não gera erro nenhum e por isso é a mais traiçoeira. De fato, o texto que aparecia entre chamadas de ferramenta agora chega em blocos thinking de progresso, com conteúdo vazio no padrão display: "omitted". Consequentemente, aplicações que faziam streaming desses avisos ficam mudas entre tool calls, sem log de falha. Ajustar thinking.display resolve.

O Claude Opus 5.5 é gratuito? Onde usar hoje

Primeiro, não existe camada gratuita de API: o uso é pago por token, e o acesso em assinatura vem pelos planos do Claude. Contudo, a mudança mais silenciosa aconteceu no terminal. O Claude Opus 5.5 virou, inclusive, o modelo padrão do Claude Code na versão 2.1.280, publicada no mesmo 22 de setembro de 2026, e a troca foi automática para quem atualizou o CLI.

Na prática, alguém que só rodou o update pode notar respostas com raciocínio diferente sem ter mudado configuração alguma. Por isso, vale revisar os comandos do Claude Code e o efeito do novo padrão de effort antes de culpar o próprio prompt. Além disso, os limites da janela de 5 horas subiram nos planos Pro, Max e Team, e assinantes ganharam resets de rate limit.

Por fim, a disponibilidade cobre Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud e Microsoft Foundry. Dois betas novos merecem atenção: inline-tools-2026-09-15, que define uma tool inteira dentro da mensagem sem quebrar o cache, e compact-2026-09-04, de compactação sob demanda. Este último ganha relevância justamente porque os blocos de raciocínio agora dependem da conversa em que nasceram.

Vale a pena migrar para o Claude Opus 5.5 agora?

Recomendamos migrar primeiro as cargas de leitura e análise, e deixar para depois qualquer pipeline que dependa de forced tool use. De fato, a conta é favorável em quase todo cenário de código, mas o risco não está no preço e sim nas quatro incompatibilidades. Em vez de trocar a string do modelo em produção, o caminho barato é rodar o mesmo conjunto de prompts em staging com effort explícito e comparar custo por tarefa, não custo por token. Para quem ainda está escolhendo entre as famílias, vale o comparativo entre ChatGPT, Claude e Gemini.

Além disso, no campo de segurança, a Anthropic afirma que este foi seu melhor resultado em auditoria comportamental automatizada, com 85% menos tentativas de burlar limites de contenção que o Opus 5, além de mais resistência a prompt injection em código e navegação. Inclusive, avaliadores externos, entre eles Frontier Design e METR, participaram do processo antes do lançamento. Há marca d’água de texto para conformidade com o AI Act europeu e opção de retenção zero de dados.

Vale registrar o contexto: este é o primeiro lançamento da Anthropic depois de Dario Amodei publicar um ensaio pedindo desaceleração na fronteira, e a empresa descreve o modelo exatamente assim, como o primeiro lançamento desde esse pedido. Por fim, a leitura de gráficos, diagramas e capturas de tela ficou bem mais precisa, o que torna várias gambiarras de prompt para visão desnecessárias.

Publicidade

Qual a diferença entre o Claude Opus e o Sonnet?
O Opus é a linha de topo, voltada a raciocínio e código agêntico de longa duração, e custa 4 dólares por milhão de tokens de entrada. Por outro lado, o Sonnet 5 é a linha intermediária, a 2 dólares por milhão, indicada para volume alto e tarefas mais curtas.
O Claude Opus 5.5 é gratuito?
Não. Na prática, na API o uso é pago por token e não há camada gratuita. Além disso, o acesso por assinatura vem nos planos Pro, Max e Team, que tiveram os limites da janela de 5 horas ampliados no lançamento.
Quanto custa o Claude Opus 5.5 por milhão de tokens?
Custa 4 dólares por milhão de tokens de entrada e 20 por milhão de saída. Além disso, a leitura de cache sai por 0,20 dólar e o processamento em lote custa metade: 2 e 10 dólares.
O Claude Opus 5.5 é melhor que o GPT-6?
Nos benchmarks divulgados pela Anthropic, sim: 66,4% contra 57,9% do GPT-6 Astra no Terminal-Bench 4.0 e 54,4% contra 53,3% no FrontierCode v1.1. Contudo, são números da própria fabricante, sem verificação independente até agora.
Preciso mudar meu código para usar o Opus 5.5?
Provavelmente sim. Na prática, desativar thinking, usar forced tool use e chamar o toolset computer_20251124 passaram a retornar erro 400 na Claude API. Além disso, blocos de raciocínio antigos também ficaram atrelados ao modelo e à conversa em que foram gerados.