O Claude Opus 5.5 é o novo modelo de topo da Anthropic, lançado em 22 de setembro de 2026. Ele custa 4 dólares por milhão de tokens de entrada e 20 de saída, roda cerca de 40% mais barato que o Opus 5 e lidera o Terminal-Bench 4.0 com 66,4%, acima do Fable 5.1.
Na prática, o comunicado que circulou na imprensa parou no preço. Portanto, vale começar pelo que ficou de fora: a atualização traz quatro mudanças incompatíveis na API e trocou o modelo padrão do Claude Code sem avisar ninguém. Na prática, quem mantém agente em produção pode ver o comportamento mudar hoje sem ter tocado numa linha de código.
O que é o Claude Opus 5.5 e o que mudou?
O Claude Opus 5.5 abre a família 5.5 da Anthropic e foi desenhado, sobretudo, para agentes de código que rodam por horas. De fato, a documentação oficial descreve o posicionamento dele como “para coding agêntico de longa duração e trabalho de conhecimento”, e recomenda começar por ele na maioria das cargas. Por outro lado, a própria Anthropic sugere manter o Fable 5.1 em raciocínio muito exigente ou horizonte extremamente longo.
Na prática, o identificador é claude-opus-5-5 na Claude API, no Google Cloud e no Microsoft Foundry, e anthropic.claude-opus-5-5 no Amazon Bedrock. Além disso, a janela de contexto segue em 1 milhão de tokens, com saída máxima de 128 mil e corte de conhecimento em junho de 2026. Inclusive, a aposentadoria do modelo só acontece a partir de 22 de setembro de 2027, o que dá previsibilidade a quem depende de engenharia de contexto bem calibrada.
Sonnet 5.5 e Haiku 5.5, por sua vez, foram anunciados para as próximas semanas. Logo, quem usa os modelos menores como camada barata de triagem ainda vai conviver com gerações misturadas por um tempo.
Quanto custa o Claude Opus 5.5 na API?
Primeiro, o Claude Opus 5.5 custa 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída. Por outro lado, o Opus 5 cobrava 5 e 25 dólares, ou seja, a tabela por token caiu 20%. Além disso, a leitura de cache despencou para 0,20 dólar por milhão, 60% abaixo do anterior e equivalente a 5% do preço de entrada. Na prática, a escrita de cache fica em 5 dólares na janela de 5 minutos e 8 dólares na de 1 hora, enquanto o processamento em lote sai pela metade: 2 e 10 dólares.
De fato, segundo a Anthropic, a economia real chega a 40% em cargas típicas, e ela vem de três vetores somados: preço por token 20% menor, leitura de cache 60% mais barata e menos tokens consumidos por tarefa. Consequentemente, quem já usa cache agressivo tende a capturar bem mais do que os 20% óbvios da tabela.
Por fim, existe ainda o fast mode, em research preview apenas na Claude API, atrás do beta header fast-mode-2026-02-01. Ele cobra 8 e 40 dólares e entrega, assim, até 2,5 vezes mais velocidade. Contudo, o recurso não está disponível no Bedrock, no Google Cloud nem no Foundry, o que inviabiliza depender dele em stack multicloud.
Publicidade
Opus 5 vs Opus 5.5: o que os benchmarks mostram?
O Claude Opus 5.5 lidera, de fato, todos os benchmarks divulgados pela Anthropic, com a maior folga em terminal e código agêntico. Veja a seguir os números oficiais lado a lado com o Claude Fable 5.1 e com a geração anterior.
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 66,4% | 55,8% | 52,3% | 57,9% |
| FrontierCode v1.1 | 54,4% | 50,3% | 48,0% | 53,3% |
| CursorBench 4.0 | 57,8% | 51,8% | 46,6% | n/d |
| OSWorld 2.0 (computer use) | 81,8% | 80,7% | 74,0% | n/d |
| Humanity’s Last Exam | 67,7% | 65,6% | 63,6% | n/d |
| GDPval-AA v2.1 (Elo) | 1846 | 1735 | 1708 | n/d |
| Preço por milhão (entrada/saída) | US$ 4 / US$ 20 | US$ 10 / US$ 50 | US$ 5 / US$ 25 | n/d |
O detalhe que muda a decisão de arquitetura está na coluna de preço. Na prática, em esforço médio, o modelo marca 54,4% no FrontierCode por cerca de um quinto do custo do GPT-6 Astra, que fica em 53,3%. Da mesma forma, ele empata com o Astra no Terminal-Bench por volta de 40% do custo e supera o GPT-5.6 Sol em 11 pontos no CursorBench pagando perto de um terço. Inclusive, a geração de saída ficou mais de 30% mais rápida que a do Opus 5.
Inclusive, entre os relatos de quem recebeu acesso antecipado, a Anthropic cita uma migração de 680 mil linhas concluída em menos de 24 horas e uma auditoria de uma base de 200 mil linhas em menos de 3 horas, tarefa que levava mais de 20 horas no Opus 5. Contudo, são números da fabricante, não verificações independentes. De fato, o salto no Terminal-Bench é consistente com esse tipo de ganho em tarefa longa, principalmente quando o fluxo envolve criar subagents no Claude Code para dividir o trabalho.
Publicidade
O que quebra no seu código com o Claude Opus 5.5?
De fato, quatro chamadas que funcionavam no Opus 5 agora retornam erro 400 no Claude Opus 5.5. Portanto, essa é a parte da migração que exige leitura antes de trocar a string do modelo.
Checklist de incompatibilidades:
- Thinking não desliga mais. Enviar
thinking: {"type":"disabled"}ou budget manual devolveinvalid_request_error. Assim, omita o campo ou use{"type":"adaptive"}. - Forced tool use saiu.
tool_choicecomanyou nome fixo retorna 400, inclusive na contagem de tokens. Logo, useautocom strict tool use ou structured outputs. - Thinking blocks ficaram atrelados ao modelo e à conversa. Além disso, blocos de Fable e Mythos não são lidos, e alterar system prompt, tools ou mensagens anteriores invalida o replay.
- Computer use trocou de toolset. Só
computer_toolset_20260801é aceito na Claude API e no Google Cloud. Por outro lado, no Bedrock a ferramenta antiga continua funcionando.
Na prática, o controle de raciocínio migrou para o parâmetro effort, cujo padrão caiu de high para medium. Além disso, o modelo pensa mais por turno no mesmo nível de esforço, sobretudo em xhigh e max. Logo, refazer o sweep de effort e deixar folga no max_tokens evita truncamento silencioso na primeira semana.
Há ainda uma quinta mudança que não gera erro nenhum e por isso é a mais traiçoeira. De fato, o texto que aparecia entre chamadas de ferramenta agora chega em blocos thinking de progresso, com conteúdo vazio no padrão display: "omitted". Consequentemente, aplicações que faziam streaming desses avisos ficam mudas entre tool calls, sem log de falha. Ajustar thinking.display resolve.
O Claude Opus 5.5 é gratuito? Onde usar hoje
Primeiro, não existe camada gratuita de API: o uso é pago por token, e o acesso em assinatura vem pelos planos do Claude. Contudo, a mudança mais silenciosa aconteceu no terminal. O Claude Opus 5.5 virou, inclusive, o modelo padrão do Claude Code na versão 2.1.280, publicada no mesmo 22 de setembro de 2026, e a troca foi automática para quem atualizou o CLI.
Na prática, alguém que só rodou o update pode notar respostas com raciocínio diferente sem ter mudado configuração alguma. Por isso, vale revisar os comandos do Claude Code e o efeito do novo padrão de effort antes de culpar o próprio prompt. Além disso, os limites da janela de 5 horas subiram nos planos Pro, Max e Team, e assinantes ganharam resets de rate limit.
Por fim, a disponibilidade cobre Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud e Microsoft Foundry. Dois betas novos merecem atenção: inline-tools-2026-09-15, que define uma tool inteira dentro da mensagem sem quebrar o cache, e compact-2026-09-04, de compactação sob demanda. Este último ganha relevância justamente porque os blocos de raciocínio agora dependem da conversa em que nasceram.
Vale a pena migrar para o Claude Opus 5.5 agora?
Recomendamos migrar primeiro as cargas de leitura e análise, e deixar para depois qualquer pipeline que dependa de forced tool use. De fato, a conta é favorável em quase todo cenário de código, mas o risco não está no preço e sim nas quatro incompatibilidades. Em vez de trocar a string do modelo em produção, o caminho barato é rodar o mesmo conjunto de prompts em staging com effort explícito e comparar custo por tarefa, não custo por token. Para quem ainda está escolhendo entre as famílias, vale o comparativo entre ChatGPT, Claude e Gemini.
Além disso, no campo de segurança, a Anthropic afirma que este foi seu melhor resultado em auditoria comportamental automatizada, com 85% menos tentativas de burlar limites de contenção que o Opus 5, além de mais resistência a prompt injection em código e navegação. Inclusive, avaliadores externos, entre eles Frontier Design e METR, participaram do processo antes do lançamento. Há marca d’água de texto para conformidade com o AI Act europeu e opção de retenção zero de dados.
Vale registrar o contexto: este é o primeiro lançamento da Anthropic depois de Dario Amodei publicar um ensaio pedindo desaceleração na fronteira, e a empresa descreve o modelo exatamente assim, como o primeiro lançamento desde esse pedido. Por fim, a leitura de gráficos, diagramas e capturas de tela ficou bem mais precisa, o que torna várias gambiarras de prompt para visão desnecessárias.
Publicidade


























