Claude Opus 5.5: Benchmarks, Preços e Novidades

claude-opus-5-5

A Anthropic lançou o Claude Opus 5.5 e apresenta o primeiro modelo da nova família Claude 5.5.

A atualização é direcionada, de forma bem direta, a trabalhos exigentes: grandes projetos de codificação, agentes de IA de longa duração, pesquisa, análise de dados e tarefas profissionais de conhecimento. A Anthropic afirma que o Opus 5.5 alcança, aproximadamente, desempenho no nível do Claude Fable 5.1 em muitos tipos de carga de trabalho, custando significativamente menos para executar do que o Opus 5 anterior.

Para desenvolvedores, as principais melhorias não são apenas pontuações de benchmarks mais altas. O Claude Opus 5.5 também traz custos menores de tokens, uma janela de contexto de 1 milhão de tokens, até 128K tokens de saída, raciocínio adaptativo e um modo opcional mais rápido.

Aqui está o que mudou.

Claude Opus 5.5 em Poucas Palavras

Especificação Claude Opus 5.5
Data de lançamento 22 de setembro de 2026
ID do modelo de API claude-opus-5-5
Janela de contexto 1M tokens
Saída máxima 128K tokens
Saída máxima da Batch API 300K tokens, beta
Preço de entrada US$ 4 / 1M tokens
Preço de saída US$ 20 / 1M tokens
Leitura de cache US$ 0,20 / 1M tokens
Raciocínio Adaptativo, sempre ligado
Esforço padrão Médio
Corte de conhecimento Junho de 2026
Entrada Texto e imagens
Saída Texto

A Anthropic lista o Claude Opus 5.5 como seu modelo Opus mais recente e o posiciona para codificação de agentes de longa duração e trabalho de conhecimento.

O que há de Novo no Claude Opus 5.5?

1. Melhor Desempenho em Tarefas de Codificação Longas e Complexas

A codificação é uma das áreas mais claras para as quais a Anthropic está mirando com este lançamento.

Em vez de se concentrar apenas em perguntas de codificação isoladas, o Opus 5.5 é projetado para tarefas que podem envolver muitos arquivos, ferramentas, decisões e etapas repetidas.

A Anthropic relata que um avaliador inicial usou o modelo para auditar e corrigir uma codebase com 200.000 linhas em menos de três horas, em comparação com mais de 20 horas para o Opus 5 no mesmo exemplo. A Anthropic também testou o modelo em uma reescrita de C para Rust do HAProxy, em que o Opus 5.5 concluiu o trabalho mais rápido e com um custo reportado menor do que o Fable 5.1.

terminal-coding
Isso torna a atualização especialmente relevante para fluxos de trabalho como:

  • Migrações de grandes bases de código
  • Refatoração em todo o repositório
  • Depuração em múltiplos arquivos
  • Revisões de código automatizadas
  • Agentes de codificação de longa duração
  • Manutenção e testes de software

A história maior, portanto, não é apenas “respostas melhores de codificação”. É o Claude se tornando mais prático para trabalhos de engenharia que precisam permanecer coerentes ao longo de muitas etapas.

Benchmarks do Claude Opus 5.5

A Anthropic publicou resultados de benchmarks cobrindo codificação, fluxos de trabalho de negócios, raciocínio, trabalho de conhecimento e uso de computador.

Benchmark Opus 5.5 Opus 5 GPT-6 Astra
Terminal-Bench 4.0 66,4% 52,3% 57,9%
FrontierCode v1.1 54,4% 48,0% 53,3%
GDPval-AA v2.1 1846 1708 1542
AutomationBench 40,0% 26,9% 41,4%
Humanity’s Last Exam 67,7% 63,6% 57,2%
Terminal-Bench-Science 0.1 58,7% 29,0% 64,6%

Esses números mostram por que resultados individuais de benchmarks precisam de contexto. O Opus 5.5 lidera o GPT-6 Astra nos resultados publicados pela Anthropic em Terminal-Bench, FrontierCode, GDPval-AA e Humanity’s Last Exam. Mas o GPT-6 Astra pontua mais alto no AutomationBench e no Terminal-Bench-Science na mesma tabela.

opus-5-5-iweaver
A própria Anthropic também alerta que pequenas diferenças de benchmarks estão ficando menos úteis para prever o que os usuários terão na prática. Então, em vez de perguntar qual modelo “vence” no geral, faz mais sentido comparar modelos em torno de uma carga de trabalho específica como codificação, pesquisa, automação de agentes ou análise de documentos.

Preços do Claude Opus 5.5

O preço pode ser uma das atualizações mais importantes.

O Claude Opus 5.5 custa:

  • US$ 4 por 1 milhão de tokens de entrada
  • US$ 20 por 1 milhão de tokens de saída
  • US$ 5 por 1 milhão de tokens para gravações de cache de 5 minutos
  • US$ 0,20 por 1 milhão de tokens para leituras de cache

Em comparação, o Claude Opus 5 custa US$ 5 por 1 milhão de tokens de entrada e US$ 25 por 1 milhão de tokens de saída. As leituras de cache no Opus 5 custam US$ 0,50 por 1 milhão de tokens.

Modelo Entrada Saída
Claude Opus 5.5 US$ 4 / 1M US$ 20 / 1M
Claude Opus 5 US$ 5 / 1M US$ 25 / 1M

O preço bruto por token é, portanto, 20% menor. A Anthropic diz que a redução total de custo pode chegar a cerca de 40% para cargas de trabalho típicas, porque o Opus 5.5 também tende a usar menos tokens para concluir uma tarefa.

Isso importa especialmente para agentes que fazem chamadas repetidas de ferramentas, leem contextos grandes e ficam rodando por períodos prolongados.

Janela de Contexto de 1M e Saída de 128K

O Claude Opus 5.5 mantém a grande capacidade de contexto introduzida nos modelos Claude mais recentes.

Ele oferece uma janela de contexto de 1 milhão de tokens e até 128K tokens de saída em uma solicitação padrão. A Batch API também suporta até 300K tokens de saída em beta.

Uma janela de contexto maior pode ser útil ao trabalhar com:

  • Grandes repositórios de código
  • Coleções de pesquisa
  • Relatórios longos
  • Múltiplos documentos
  • Contratos e materiais financeiros
  • Históricos extensos de agentes

Para fluxos de trabalho com muitos documentos, ferramentas como iWeaver AI Summarizer também podem ajudar a transformar grandes coleções de PDFs, documentos, vídeos e outros materiais de origem em resumos estruturados e pontos-chave antes de uma análise mais profunda.

Modo Rápido do Claude Opus 5.5

Usuários que se importam mais com latência também podem usar o Modo Rápido.

A Anthropic afirma que o Modo Rápido pode executar o Opus 5.5 com até 2,5 vezes a velocidade padrão no Claude Code e na Claude Platform.

O custo-benefício é o preço:

  • US$ 8 / 1M tokens de entrada
  • US$ 40 / 1M tokens de saída

Isso é o dobro do preço padrão dos tokens da API, então o Modo Rápido faz mais sentido quando o tempo de resposta importa mais do que minimizar custo.

Claude Opus 5.5 vs Opus 5: O que Realmente Mudou?

A atualização é mais significativa do que apenas um salto no número da versão.

Em comparação com o Opus 5, o Opus 5.5 oferece:

Área Mudança
Codificação Mais forte em tarefas de longa duração e multiarquivo
Fluxos de trabalho de agentes Melhor eficiência em tarefas estendidas
Preço de entrada US$ 5 → US$ 4 por milhão de tokens
Preço de saída US$ 25 → US$ 20 por milhão de tokens
Leituras de cache US$ 0,50 → US$ 0,20 por milhão de tokens
Contexto Continua com 1M tokens
Saída máxima Continua com 128K
Raciocínio Raciocínio adaptativo sempre ligado

Desenvolvedores que migram aplicações existentes do Opus 5 devem observar que o Opus 5.5 também introduz várias mudanças comportamentais. Por exemplo, o raciocínio não pode mais ser desativado, e parte do comportamento de uso de ferramentas mudou. A Anthropic recomenda revisar a documentação de migração antes de simplesmente substituir o ID do modelo em aplicações de produção.

Onde o Claude Opus 5.5 Está Disponível?

O Claude Opus 5.5 está disponível via Claude Platform usando: claude-opus-5-5

A Anthropic também lista suporte por Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform na AWS. O acesso para consumidores está disponível em todos os planos pagos do Claude suportados.

Teste o Claude Opus 5.5 no iWeaver

Você também pode testar o Claude Opus 5.5 no iWeaver sem configurar uma API. O iWeaver oferece créditos diários gratuitos, então você pode testar o modelo com tarefas reais como análise de documentos, pesquisa, escrita, sumarização e outros fluxos de trabalho de conhecimento antes de decidir se ele atende às suas necessidades.

Para usuários que apenas querem experimentar o Claude Opus 5.5 sem gerenciar chaves de API, cobrança ou configuração de desenvolvimento, esta é uma forma simples de começar.

O Claude Opus 5.5 Vale a Pena Ser Usado?

O Claude Opus 5.5 é mais interessante se seu trabalho envolve tarefas que são tanto complexas quanto de longa duração.

Para perguntas curtas ou geração leve, usar um modelo da classe Opus ainda pode ser desnecessário. Mas para grandes projetos de codificação, pesquisas com muitos documentos, análise de negócios, agentes autônomos e fluxos de trabalho nos quais erros ou tentativas repetidas ficam caros, a combinação de desempenho mais forte e custos menores de tokens é significativa. O lançamento também muda o cenário competitivo entre modelos de ponta. Agora, o Claude Opus 5.5 fica entre os modelos Fable de maior nível da Anthropic e as opções mais acessíveis da classe Sonnet, competindo diretamente com modelos como o GPT-6 Astra em codificação avançada e cargas de trabalho de agentes.

Isso torna a próxima comparação especialmente interessante: Claude Opus 5.5 vs GPT-6.