Claude Sonnet 5.5 é o modelo da Anthropic com foco em eficiência para o trabalho profissional do dia a dia. Lançado em 28 de setembro de 2026, ele fica abaixo do Opus 5.5 para os problemas abertos mais difíceis, mas traz ganhos significativos em programação, criação de documentos, compreensão de imagens e tarefas de longa duração. As mudanças mais práticas são diretas: a Anthropic afirma que ele gera resultados mais de 30% mais rápido do que o Sonnet 5, mantém os mesmos preços de tokens da API e pode custar até 30% menos por tarefa concluída porque, com frequência, usa menos tokens.
Ele foi pensado para pessoas que querem um modelo capaz para tarefas bem definidas, sem pagar pelo Opus em cada solicitação. A escolha do modelo raramente depende apenas da maior pontuação de benchmark; latência, tentativas (retries), uso de tokens e revisão humana podem ter um impacto maior no custo real de um fluxo de trabalho.
Claude Sonnet 5.5 em resumo
| Detalhe | Claude Sonnet 5.5 |
|---|---|
| Data de lançamento | 28 de setembro de 2026 |
| Nome do modelo da API | claude-sonnet-5-5 |
| Preço de entrada padrão | US$ 2 por 1M tokens |
| Preço de saída padrão | US$ 10 por 1M tokens |
| Preço de leitura do cache | US$ 0,20 por 1M tokens |
| Preço de escrita do cache | US$ 2,50 por 1M tokens |
| Melhor para | Programação bem delimitada e tarefas profissionais |
| Disponibilidade | Produtos da Claude, Claude Platform, AWS, Google Cloud e Microsoft Azure |
Esses números vêm do anúncio do Sonnet 5.5 da Anthropic. Os preços e as condições de acesso por provedores de nuvem podem variar, então as equipes devem verificar a plataforma que realmente usam antes de estimar custos de produção.
O que mudou em relação ao Sonnet 5?
A atualização é mais forte onde um modelo precisa fazer trabalho, em vez de apenas responder a uma pergunta. A Anthropic destaca correção de bugs, documentos mais bem acabados, apresentações, planilhas, design visual e tarefas mais longas. O Sonnet 5.5 também oferece esforço ajustável: configurações mais baixas priorizam velocidade e menor uso de tokens, enquanto configurações mais altas permitem mais raciocínio e verificação. A Anthropic define o Medium como padrão no Claude Code e nos seus apps, enquanto a Claude Platform define o High como padrão.
As principais afirmações de velocidade e custo exigem uma formulação cuidadosa. “30%+ mais rápido” se refere à geração de saída em comparação com o Sonnet 5. “Até 30% menos” se refere ao custo observado da Anthropic por tarefa, não a um desconto em cada token. O preço da API listado continua sendo US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, então a economia real depende de o novo modelo concluir seu trabalho com respostas mais curtas, menos tentativas (retries) ou menos chamadas de ferramentas.

Benchmarks do Claude Sonnet 5.5
A Anthropic publicou várias avaliações que abrangem programação agentic e trabalho de conhecimento. Elas mostram uma melhoria grande em relação ao Sonnet 5 em alguns ambientes e resultados próximos ao Opus em outros.
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 10,3% | 66,4% | Não reportado |
| FrontierCode 1.1 Main | 46,2% em Max | 42,4% | 54,4% | 49,3%; 52,1% em Xhigh |
| CursorBench 4.0 | 55,5% | 34,1% | 57,8% | Não reportado |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
A tabela é útil, mas não é um ranking universal. As configurações de esforço, os “agent harnesses”, as ferramentas, as salvaguardas e os métodos de pontuação variam. A Anthropic também observa que mais raciocínio nem sempre melhorou os resultados: no FrontierCode, o Sonnet 5.5 em Max às vezes fez mudanças fora do escopo solicitado. A melhor configuração produz um resultado aceitável com edições controladas, não necessariamente a que gasta mais computação.
Programação e trabalho com agentes
O resultado de 70,6% do Sonnet 5.5 no Terminal-Bench 4.0 é o número mais chamativo do lançamento, mas o fluxo de trabalho ao redor importa mais do que o destaque. Para um desenvolvedor, um modelo útil de programação precisa entender o repositório, fazer uma mudança direcionada, executar as verificações apropriadas e parar antes de expandir a tarefa. A velocidade só é valiosa quando a saída continua fácil de revisar.
Isso torna o Sonnet 5.5 um candidato sensato para trabalho limitado, como diagnosticar um bug, implementar uma funcionalidade claramente especificada, revisar uma pull request ou refatorar um componente conhecido. Migrações grandes e decisões arquiteturais ambíguas ainda podem se beneficiar do Opus 5.5, que a Anthropic posiciona explicitamente para julgamento sustentado. Uma avaliação justa deve, portanto, usar tarefas reais de repositório e medir correção, edições desnecessárias, tempo decorrido, tokens totais e tempo de revisão humana.
Documentos, planilhas e trabalho de conhecimento
O lançamento também é igualmente relevante fora do desenvolvimento de software. A Anthropic descreve o Sonnet 5.5 como forte na criação de documentos, slides e planilhas, enquanto os resultados de GDPval-AA e AA-Briefcase foram pensados para refletir trabalho profissional de conhecimento. Essas pontuações não provam que todo relatório será preciso, mas ajudam a apoiar a testagem do modelo em tarefas estruturadas com material de origem claro e uma entrega verificável.
Um fluxo de trabalho prático pode começar com vários relatórios, notas de reunião e uma planilha; depois, pedir ao modelo que identifique acordos e contradições, extraia números com referências de fonte e redija um briefing executivo. A salvaguarda mais importante é a verificação: alegações numéricas devem ser conferidas com a fonte, e conclusões consequentes ainda precisam de uma revisão humana qualificada. Se o primeiro desafio for organizar material de fontes misturadas, o AI Summarizer do iWeaver pode ajudar a transformar PDFs, documentos, páginas da web, áudio, imagens e vídeo em resumos ou notas estruturadas antes de uma análise mais profunda.
Preços no contexto
O Sonnet 5.5 e o GPT-6 Sol compartilham a mesma lista de preço padrão: US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. O Opus 5.5 custa US$ 4 e US$ 20, respectivamente. Esses números tornam o Sonnet atrativo para tarefas repetidas e bem definidas, mas a comparação por taxa de tokens é incompleta. Tamanho do contexto, cache, cobranças por ferramentas, esforço de raciocínio, execuções falhas e tamanho da saída afetam a conta final.
Para avaliação em produção, escolha um conjunto representativo de tarefas e registre o custo total da tarefa, em vez de considerar apenas o preço por token. Um modelo mais barato que exige correções repetidas pode custar mais do que o esperado, enquanto um modelo mais caro pode ser econômico quando conclui uma tarefa de alto valor em uma única passagem. O mesmo conjunto de testes também deve ser reexecutado após atualizações do modelo, porque o comportamento do provedor e as configurações de atendimento podem mudar.
Vale a pena usar o Claude Sonnet 5.5?
O Sonnet 5.5 vale a pena testar se a maior parte do seu trabalho é claramente delimitada e você valoriza responsividade, preços de API previsíveis e bom desempenho em programação ou documentos. Ele é menos claramente o padrão certo quando o problema é ambíguo, o custo de um erro sutil é alto, ou a tarefa depende de julgamento sustentado em muitas etapas; nesses casos, é mais próximo do papel declarado do Opus 5.5.
A conclusão mais forte não é que o Sonnet 5.5 “supera” todas as alternativas. É que a Anthropic reduziu a distância entre suas categorias do dia a dia e premium, preservando uma diferença de preço significativa. Use os benchmarks para decidir o que merece uma tentativa e, depois, escolha com base nas suas próprias fontes, prompts, padrões de revisão e custo total da tarefa. Para uma decisão direta por categoria, veja Claude Sonnet 5.5 vs Opus 5.5; para ideias de configuração, continue com How to Use Claude Sonnet 5.5.
