Claude Sonnet 5.5, lançado pela Anthropic em 28 de setembro, fica a apenas dois pontos de Opus 5.5 na maioria de seus benchmarks e custa a metade. Isso torna a escolha de modelo em Claude Code uma decisão de custos, não de capacidade. Mas metade do preço não é metade do custo, e nessa diferença está a decisão real.
Um dado de contexto antes dos números: Claude Code não usa Sonnet por padrão. Nos planos Pro, Max, Team e Enterprise, e na API da Anthropic, o modelo default é Opus 5.5. Então a pergunta que a maioria dos times se faz esta semana não é “com qual modelo começo?”, mas “vale a pena descer de Opus, e para qual trabalho?”.
O que é Claude Sonnet 5.5?
Claude Sonnet 5.5 é o segundo modelo da família Claude 5.5 da Anthropic, pensado como o complemento mais rápido e barato de Opus 5.5. A Anthropic diz que sua força estão as “tarefas do dia a dia bem delimitadas, a correção de bugs e a criação de documentos polidos”, e que em relação ao Sonnet 5 “runs 30%+ faster, and costs up to 30% less for most work”.
Ficou disponível para todos no mesmo dia do anúncio: na Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. O ID do modelo é claude-sonnet-5-5, com janela de contexto de 1M de tokens, saída máxima de 128K, conhecimento até junho de 2026 e retirada não antes de 28 de setembro de 2027.
A Anthropic anunciou um terceiro modelo, Haiku 5.5, para “as próximas semanas”. No momento de publicar esta nota, ainda não está disponível.
Claude Sonnet vs Opus: quão próximo Sonnet 5.5 está de Opus 5.5?
Muito próximo segundo a tabela da própria Anthropic, e até à frente em um benchmark de programação. Todos os números são reportados pela Anthropic; ainda não há replicação independente.
| Benchmark | Sonnet 5.5 | Opus 5.5 | Sonnet 5 |
|---|---|---|---|
| Terminal-Bench 4.0 (agentic coding) | 70,6 % | 66,4 %¹ | 10,3 % |
| CursorBench 4.0 | 55,5 % | 57,8 % | 34,1 % |
| FrontierCode 1.1 (Main) | 52,1 % (Xhigh) | 54,4 % | 42,4 % |
| GDPval-AA v2.1² | 1844 | 1846 | 1449 |
| OSWorld 2.1 (computer use) | 80,1 % | 81,8 % | 57,0 % |
¹ Opus 5.5 reportado com esforço Xhigh, sua melhor pontuação. ² GDPval-AA foi executado pela Artificial Analysis em um despliegue anterior ao lançamento que, segundo a Anthropic, tinha um bug de structured outputs já corrigido.
O salto em Terminal-Bench, de 10,3 para 70,6 , é a manchete, e é o número que torna Sonnet 5.5 uma opção séria dentro de um agente de terminal. Sonnet 5 não era.
Mas a Anthropic é inusitadamente direta sobre o limite. O anúncio diz que os benchmarks “capture only one facet” e que “Opus 5.5 remains clearly stronger at complex, open-ended work requiring sustained judgment”. O system card vai além: Sonnet 5.5 “usually does not reach the level of Opus 5.5”. Eu leio a tabela como “Sonnet 5.5 já consegue fazer quase tudo o que Opus faz em tarefas bem definidas”, não como “Sonnet 5.5 é igual a Opus”.
Qual é o preço de Claude Sonnet 5.5 em relação a Opus?
A metade, em quase todas as linhas da tabela de preços:
| Por 1M de tokens | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Input | $2 | $4 |
| Output | $10 | $20 |
| Escrita em cache | $2,50 | $5 |
| Leitura de cache | $0,20 | $0,20 |
A última linha é a que importa. A leitura de cache custa o mesmo nos dois modelos. E uma sessão de agentic coding é, sobretudo, leitura de cache: cada turno reenvia a conversa, o contexto do repositório e os resultados das ferramentas, e quase tudo volta do cache.
Um turno ilustrativo (minha aritmética, não uma medição): 100K tokens lidos do cache, 5K de input novo e 2K de output.
- Opus 5.5: $0,020 cache + $0,020 input + $0,040 output = $0,080
- Sonnet 5.5: $0,020 cache + $0,010 input + $0,020 output = $0,050
Isso é cerca de 37 mais barato, não 50 . Quanto mais longa a sessão e maior o contexto em cache, mais os dois se aproximam. A economia que sobrevive está nos tokens de saída, e por isso a eficiência de tokens de Sonnet 5.5 pesa mais que seu preço de tabela.
Os gráficos de custo por tarefa da Anthropic apontam na mesma direção. Nas palavras deles, Sonnet 5.5 “complements Opus 5.5 best when running at lower effort settings, where it costs less per task. At higher settings, it can perform comparably at a similar cost”. Dito de outra forma: se você rodar Sonnet 5.5 em Xhigh para igualar Opus, em boa parte você volta a pagar a fatura de Opus.
Qual é o melhor modelo de Claude para programar: Sonnet 5.5 ou Opus 5.5?
Minha leitura, para um time que já trabalha com Claude Code:
- Mantenha Opus 5.5 como padrão para o trabalho ambíguo: decisões de arquitetura, debugging sem causa clara, mudanças em vários repositórios, qualquer coisa em que você gostaria que um engenheiro sênior te contradissesse. É exatamente a categoria que, segundo a Anthropic, Opus continua dominando.
- Mude o trabalho bem delimitado para Sonnet 5.5 em esforço medium: implementar uma feature especificada, corrigir um bug com reprodução conhecida, escrever testes, refatorações com um objetivo claro. Aí você nota a velocidade e a diferença de custo é maior.
- Considere
opusplan, um modo de Claude Code que usa Opus em plan mode e muda para Sonnet para a execução. É a forma mais limpa de aplicar essa divisão sem pensar em cada tarefa. - Para cargas de trabalho por API fora de Claude Code (bots de review, pipelines batch, agentes em CI), Sonnet 5.5 passa a ser o primeiro candidato óbvio. CodeRabbit, citado pela Anthropic, diz que planeja “move simple and moderate reviews over now”. É um depoimento de cliente publicado pelo próprio fornecedor, então considere com cuidado, mas é o padrão que eu esperaria.
O ponto estratégico para CTOs é que a decisão do modelo padrão mudou de categoria. Na geração anterior, Sonnet era a opção econômica em que você aceitava perder qualidade. Nesta, a lacuna em trabalho delimitado é tão pequena que escolher modelo se torna uma política de roteamento, e políticas de roteamento vão nas convenções do time, não nos hábitos de cada desenvolvedor.
Se o seu time além disso compara agentes, o mesmo raciocínio se aplica entre provedores: vimos em Claude Code vs Codex e no lançamento do Gemini 3.7 Flash.
Como usar Sonnet 5.5 no Claude Code?
Sonnet 5.5 requer Claude Code v2.1.284 ou superior; primeiro execute claude update. Depois:
- Dentro de uma sessão:
/model sonnet - Ao iniciar:
claude --model sonnet - Esforço:
/effort(no Claude Code, Sonnet 5.5 usamediumpor padrão, igual ao Opus 5.5)
Olho: /model salva sua escolha como padrão para as novas sessões. Para mudar apenas na sessão atual, abra o seletor com /model e pressione s na linha do modelo.
Um detalhe para leitores enterprise: o alias sonnet aponta apenas para Sonnet 5.5 na API da Anthropic. No momento da publicação desta nota, aponta para Sonnet 4.5 no Amazon Bedrock e Google Cloud, e para Sonnet 4.6 no Claude Platform on AWS. Nesses provedores, selecione o modelo explicitamente ou defina-o com ANTHROPIC_DEFAULT_SONNET_MODEL.
Sonnet 5.5 rejeita tarefas de cibersegurança?
Mais que Sonnet 5. Sonnet 5.5 é o primeiro Sonnet que sai com salvaguardas de cibersegurança semelhantes às do Opus 5.5, e o system card da Anthropic diz sem rodeios: “users should expect increased refusals with Sonnet 5.5, even on benign cybersecurity-related tasks”. No Claude Code, as solicitações sinalizadas por cibersegurança passam automaticamente para Sonnet 5; as sinalizadas por biologia terminam em rejeição, sem modelo de fallback. Se o seu time faz pesquisa de segurança, fuzzing ou análise de binários, teste antes de fazer a mudança.
O que muda para um time técnico?
Sonnet 5.5 não substitui Opus 5.5. O que faz é valer a pena responder com intenção a pergunta “qual modelo?”. Em tarefas delimitadas e com esforço medium é mais rápido e bastante mais barato. Em sessões longas e carregadas de cache, a economia se reduz, e em trabalho aberto que exige critério, a própria Anthropic diz que Opus segue na frente. Trate como uma decisão de roteamento, deixe a regra por escrito e revise quando chegar o Haiku 5.5.