Claude Opus 5.5: Novidades, preços, benchmarks e comparação com Opus 5
Claude Opus 5.5 está disponível desde 22 de setembro de 2026, sucedendo o Opus 5 como o modelo Opus mais forte da Anthropic após apenas cerca de dois meses. A mudança mais notável não é apenas o melhor desempenho nos benchmarks: os preços regulares da API caem de 5 para 4 USD por milhão de tokens de entrada e de 25 para 20 USD por milhão de tokens de saída. A Anthropic estima que os custos para cargas de trabalho típicas baseadas em tokens sejam cerca de 40% menores em comparação com o Opus 5, pois o Opus 5.5 também deve usar tokens de forma mais eficiente.
Este resumo mostra o que é realmente novo no Opus 5.5, como preço, janela de contexto e benchmarks mudam em relação ao Opus 5, quais armadilhas de migração os desenvolvedores precisam conhecer e para quem uma mudança faz sentido. Os dados de benchmark são apresentados como valores do fabricante e não como um ranking universalmente válido.
Resumidamente
- Lançamento: Claude Opus 5.5 foi lançado em 22 de setembro de 2026 como o primeiro modelo da nova família Claude 5.5.
- Preço da API: 4 USD por milhão de tokens de entrada e 20 USD por milhão de tokens de saída; Opus 5 custa 5 e 25 USD, respectivamente.
- Leituras de cache: 0,20 USD por milhão de tokens em vez de 0,50 USD no Opus 5 – uma redução de 60%.
- Contexto: A janela de contexto permanece em até 1 milhão de tokens, com a saída máxima regular de 128.000 tokens.
- Benchmarks: A Anthropic relata ganhos particularmente significativos em relação ao Opus 5 no Terminal-Bench, CursorBench, AutomationBench e Terminal-Bench-Science.
- Migração: O nome do modelo muda para claude-opus-5-5; além disso, há alterações no Thinking, Tool Choice e Computer Use que podem afetar integrações existentes.
O que é Claude Opus 5.5?
Opus 5.5 é o novo modelo de ponta da Anthropic para codificação complexa, agentes e trabalho de conhecimento. A Anthropic o posiciona para tarefas longas e multi-etapas em grandes bases de código, uso complexo de ferramentas e fluxos de trabalho profissionais. Para quem deseja entender o Claude em geral, o resumo da Zerlo "O que é Claude AI?" fornece os fundamentos mais importantes sobre Anthropic, modelos e possibilidades de uso.
Tecnicamente, muitas coisas permanecem familiares: Opus 5.5 processa texto e imagens como entrada e gera texto como saída. A janela de contexto é de 1 milhão de tokens de acordo com a documentação atual da plataforma Claude, e a saída máxima regular é de 128.000 tokens. O conhecimento confiável é indicado como de junho de 2026. Para eventos após essa data, o modelo continuará precisando de fontes de dados externas atuais ou acesso à web/ferramentas.
O que há de novo no Opus 5.5?
1. Menores custos de token e maior eficiência
O preço de lista direto cai 20% em comparação com o Opus 5: a entrada cai de 5 para 4 USD por milhão de tokens, a saída de 25 para 20 USD. Para o cache de prompt, a diferença é maior. As leituras de cache custam 0,20 USD por milhão de tokens no Opus 5.5 em vez de 0,50 USD no Opus 5.
A Anthropic ainda fala em cerca de 40% menos custos para cargas de trabalho típicas baseadas em tokens. A razão: não apenas o preço por token é menor, mas o modelo também deve usar menos tokens em muitas tarefas. Esses 40% não são, portanto, uma garantia de desconto geral. A diferença real depende muito de quanto input, output e uso de cache um fluxo de trabalho específico gera.
2. Pensamento Adaptativo está sempre ativo
No Opus 5.5, o Thinking não pode mais ser desativado completamente. Em vez disso, o parâmetro Effort controla quanto esforço computacional o modelo deve usar para uma solicitação. O valor padrão é medium no Opus 5.5; no Opus 5, o padrão era high de acordo com a documentação do modelo. Isso é importante para comparações de custos e latência, pois dois modelos em diferentes níveis de esforço não podem ser comparados diretamente.
3. Maior foco em Codificação e Agentes
A Anthropic destaca especialmente tarefas de software de longa duração. Nos testes publicados, migrações de código em larga escala, refatorações, tarefas de terminal e fluxos de trabalho multi-ferramentas foram examinados. Tais exemplos vêm em parte da Anthropic ou de clientes de teste iniciais e, portanto, devem ser entendidos como resultados do fabricante ou testador – não como uma garantia de que cada projeto real alcançará o mesmo ganho de tempo.

Fonte: ctan.org
Opus 5.5 é particularmente voltado para desenvolvedores que automatizam fluxos de trabalho longos de codificação e agentes. O que é crucial aqui não são apenas os pontos de benchmark, mas também o consumo de tokens, o uso de ferramentas e a confiabilidade em muitas etapas de trabalho.
4. Verificações de segurança e comportamento estendidas
A Anthropic relata que o Opus 5.5 tem um desempenho melhor do que modelos anteriores em seus próprios testes de comportamento automatizados e é mais resistente à injeção de prompts do que o Opus 5. Ao mesmo tempo, a empresa enfatiza que os limites ainda existem. O modelo também é lançado com uma classe semelhante de mecanismos de proteção adicionais como o Fable 5.1, incluindo para cibersegurança, biologia e proteção contra destilação de modelo. Para sistemas produtivos, isso não substitui a gestão de direitos própria, validação de entrada ou controle de ações críticas.
Claude Opus 5.5 vs Opus 5: dados técnicos
| Característica | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Publicação | 22. September 2026 | 24. Juli 2026 |
| ID do modelo da API | claude-opus-5-5 |
claude-opus-5 |
| Janela de contexto | 1 Milhões de tokens | 1 Milhões de tokens |
| Saída máxima regular | 128.000 Tokens | 128.000 Tokens |
| Preço de entrada | 4 USD / 1 Milhões de tokens | 5 USD / 1 Milhões de tokens |
| Preço de saída | 20 USD / 1 Milhões de tokens | 25 USD / 1 Milhões de tokens |
| Leitura de cache | 0,20 USD / 1 Milhões de tokens | 0,50 USD / 1 Milhões de tokens |
| Pensamento | Pensamento Adaptativo sempre ativo | Pensamento Adaptativo configurável |
| Esforço padrão | Médio | Alto |
| Corte de conhecimento confiável | Juni 2026 | Mai 2026 |
| Status | Modelo Opus atual | Ativo, mas legado |
Claude Opus 5.5: preços em detalhes
Para desenvolvedores, a mudança de preço é uma das novidades mais importantes. A tabela a seguir mostra os preços de lista regulares da API Claude. Provedores de nuvem podem ter detalhes de faturamento próprios; impostos, sobretaxas regionais ou opções de inferência especiais não são considerados aqui.
| Custos da API por 1 milhão de tokens | Opus 5.5 | Opus 5 | Mudança |
|---|---|---|---|
| Entrada | 4 USD | 5 USD | -20 % |
| Saída | 20 USD | 25 USD | -20 % |
| Cache de 5 minutos | 5 USD | 6,25 USD | -20 % |
| Leitura de cache | 0,20 USD | 0,50 USD | -60 % |
Um exemplo de cálculo simples mostra o efeito básico: 10 milhões de tokens de entrada mais 2 milhões de tokens de saída custam 80 USD sem cache no Opus 5.5. Com o Opus 5, seriam 100 USD. Isso corresponde exatamente à redução de 20% nos preços de lista. Para agentes que usam muito cache, a diferença pode ser maior.
Além disso, para Opus 5.5, há um Modo Rápido com até 2,5 vezes a velocidade. Ele custa 8 USD por milhão de tokens de entrada e 40 USD por milhão de tokens de saída. Quem otimiza mais para custos do que para latência mínima deve, portanto, permanecer no modo normal. A Batch API pode reduzir os custos de entrada e saída em 50% para tarefas assíncronas adequadas.
Assinatura Claude e API são separadas
Opus 5.5 está disponível nos produtos Claude para usuários Pro, Max, Team e Enterprise. O uso da API Claude é cobrado separadamente de acordo com o consumo da API e não está incluído automaticamente em uma assinatura Claude Pro. Essa separação é importante para empresas, pois o uso de chat e cargas de trabalho de API produtivas podem evoluir independentemente em termos de custo.
Benchmarks: Quão mais rápido ou melhor é o Opus 5.5?
A Anthropic publica vários valores de comparação próprios para o Opus 5.5. Na seleção a seguir, apenas o Opus 5.5 é comparado com seu predecessor direto, o Opus 5. Os valores percentuais são taxas de acerto ou sucesso absolutas; para GDPval-AA, é um valor em pontos.
| Benchmark | Opus 5.5 | Opus 5 | Diferença |
|---|---|---|---|
| Terminal-Bench 4.0 | 66,4 % | 52,3 % | +14,1 Pontos percentuais |
| FrontierCode v1.1 Main | 54,4 % | 48,0 % | +6,4 Pontos percentuais |
| CursorBench 4.0 | 57,8 % | 46,6 % | +11,2 Pontos percentuais |
| GDPval-AA v2.1 | 1846 | 1708 | +138 Pontos |
| AutomationBench | 40,0 % | 26,9 % | +13,1 Pontos percentuais |
| O Exame Final da Humanidade | 67,7 % | 63,6 % | +4,1 Pontos percentuais |
| Terminal-Bench-Science 0.1 | 58,7 % | 29,0 % | +29,7 Pontos percentuais |
| OSWorld 2.0 | 81,8 % | 74,0 % | +7,8 Pontos percentuais |
Importante: Estes são resultados de benchmark publicados pela Anthropic. As configurações de teste diferem dependendo do benchmark; a menos que especificado de outra forma, a Anthropic usa configurações de esforço alto ou máximo para Opus 5.5. Mecanismos de proteção e fallbacks também podem influenciar o resultado. Um benchmark é, portanto, um indicativo de capacidades, mas não substitui um teste com seu próprio prompt, conjunto de dados, configuração de ferramentas e perfil de custo.
Para uma comparação mais ampla com outro grande provedor de modelos, o artigo da Zerlo Gemini vs. Claude também é útil. Em tais comparações, no entanto, deve-se sempre prestar atenção a qual geração de modelo específica e a qual data de teste se refere.
Migração do Opus 5 para o Opus 5.5
Quem usa Opus 5 apenas no aplicativo Claude geralmente não precisa se preocupar muito. Para integrações de API, por outro lado, há várias alterações que devem ser testadas antes de uma mudança produtiva.
- Ajustar o ID do modelo: A API usa claude-opus-5-5.
- Não desativar mais o Thinking: Com Opus 5.5, o Adaptive Thinking está sempre ativo. Os aplicativos devem controlar o esforço computacional por meio de 'effort' em vez de desativar completamente o 'Thinking'.
- Verificar a escolha da ferramenta: Variantes forçadas como 'any' ou uma ferramenta selecionada de forma fixa podem levar a um erro 400 com Opus 5.5. A Anthropic recomenda, entre outras coisas, 'auto' em combinação com uso rigoroso de ferramentas ou saída estruturada.
- Atualizar a ferramenta de uso de computador: Na API Claude e no Google Cloud, o conjunto de ferramentas de computador mais recente é previsto para Opus 5.5. Na Amazon Bedrock, devido a motivos de compatibilidade, aplicam-se em parte outras diretrizes.
- Não reescrever blocos de Thinking: Aplicativos que processam o histórico de conversas por conta própria devem tratar os blocos de Thinking com base em seu tipo e passá-los inalterados.

Fonte: ctan.org
Para fluxos de trabalho de API existentes, um teste de regressão direcionado antes da mudança de modelo vale a pena: especialmente com escolha de ferramentas, uso de computador, saídas estruturadas, conversas longas e controle de custos próprio.
Onde o Claude Opus 5.5 está disponível?
Para usuários finais, o Opus 5.5 está disponível no Claude para Pro, Max, Team e Enterprise, de acordo com a Anthropic. Desenvolvedores podem usar o modelo através da Claude Platform ou Claude API. Além disso, a Anthropic menciona Amazon Web Services, Google Cloud e Microsoft Foundry como plataformas suportadas.
A Anthropic também aumentou os limites de uso de cinco horas para planos Pro, Max, Team e Enterprise baseados em assentos com a introdução do Opus 5.5. No entanto, a quantidade de uso realmente possível ainda depende do plano, da tarefa e do consumo de tokens.
Para quem vale a pena mudar do Opus 5?
Para novos projetos de API há poucas razões para começar com Opus 5, a menos que haja um requisito de compatibilidade específico. Opus 5.5 é mais barato por token, mais atual e consistentemente atinge valores melhores em testes publicados pela Anthropic do que Opus 5 nos benchmarks considerados aqui.
Para sistemas de codificação e agentes existentes a mudança é particularmente interessante se leituras de cache, contextos longos e muitas chamadas de ferramentas representam uma grande parte dos custos. Aqui, a combinação de preços de lista mais baixos, leituras de cache significativamente mais baratas e possível eficiência de tokens pode ter um impacto maior do que a redução de preço de 20% por si só.
Para integrações produtivas com controle de ferramentas fixo a migração não deve ocorrer apenas trocando o nome do modelo. As alterações em Thinking e Tool Choice podem causar comportamento ou erros de API. Um breve catálogo de testes com fluxos de trabalho típicos e críticos é mais sensato do que um rollout sem verificação.
Limites e considerações importantes
- Benchmarks do fabricante: Os números de comparação mais importantes vêm da Anthropic. Testes independentes podem variar dependendo do prompting, ferramentas e avaliação.
- Os custos dependem da carga de trabalho: A economia de cerca de 40% frequentemente mencionada é uma estimativa para tarefas típicas baseadas em tokens, não uma economia garantida para cada chamada de API.
- Knowledge Cutoff: O conhecimento confiável é de junho de 2026. Para eventos atuais após esta data, é necessária a aquisição de informações externas.
- Opus continua Premium: Apesar da redução de preço, Opus 5.5 é voltado para tarefas exigentes. Para cargas de trabalho mais simples ou de muito alto volume, modelos Claude mais baratos podem ser mais econômicos.
- Mecanismos de segurança alteram o comportamento: Sistemas de proteção podem bloquear solicitações ou redirecioná-las para outros caminhos de processamento. Isso deve ser considerado em benchmarks e em agentes automatizados.
FAQ
Quando o Claude Opus 5.5 foi lançado?
A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026. O Opus 5 foi lançado anteriormente em 24 de julho de 2026.
Quanto custa o Claude Opus 5.5 via API?
O preço regular de lista é de US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída. Leituras de cache custam US$ 0,20 por milhão de tokens. O modo rápido custa US$ 8 para entrada e US$ 40 para saída por milhão de tokens.
O Opus 5.5 é mais barato que o Opus 5?
Sim. Os preços regulares de entrada e saída são 20% mais baixos cada. As leituras de cache são 60% mais baratas. A Anthropic estima que as cargas de trabalho típicas baseadas em tokens custam cerca de 40% menos no geral, pois o Opus 5.5 também pode precisar de menos tokens por tarefa.
O Claude Opus 5.5 tem uma janela de contexto maior que o Opus 5?
Não. Ambos os modelos são listados na documentação atual da Claude Platform com uma janela de contexto de até 1 milhão de tokens e uma saída máxima regular de 128.000 tokens.
O Opus 5.5 é melhor em programação do que o Opus 5?
Nos benchmarks de codificação e terminal publicados pela Anthropic, o Opus 5.5 supera o Opus 5, entre outros no Terminal-Bench 4.0, FrontierCode e CursorBench 4.0. No entanto, para projetos reais, a qualidade ainda deve ser testada com seu próprio código, ferramentas e configuração de prompt.
Preciso alterar minha integração de API para o Opus 5.5?
Pelo menos o ID do modelo precisa ser ajustado. Dependendo da integração, alterações em Thinking, Tool Choice e Computer Use também podem ser necessárias. Aqueles que usam essas funções devem verificar as dicas de migração da Anthropic e testar o aplicativo antes da mudança produtiva.
O Claude Opus 5.5 está incluído no plano gratuito do Claude?
A Anthropic menciona o Opus 5.5 para usuários Pro, Max, Team e Enterprise. O plano gratuito do Claude não está entre os planos listados pela Anthropic para o Opus 5.5.
Conclusão
Claude Opus 5.5 não é uma pequena atualização intermediária. Em comparação com o Opus 5, a Anthropic combina valores de benchmark publicados mais altos com preços de API mais baixos, leituras de cache significativamente mais baratas e um foco maior em tarefas longas de codificação e agentes. A janela de contexto de 1 milhão de tokens é mantida; novas são principalmente a eficiência, o comportamento do modelo e os detalhes da API em torno de Thinking e Tools.
Para novos projetos Claude exigentes, o Opus 5.5 é, portanto, a versão Opus óbvia. Para sistemas Opus 5 existentes, a mudança também vale a pena, mas deve ser testada como uma migração real devido às alterações em Thinking, Tool Choice e Computer Use. As vantagens de benchmark são promissoras, mas o resultado em seu próprio fluxo de trabalho – incluindo custos, latência e taxa de erro – continua sendo o fator decisivo.