Claude Haiku 5.5 vs Sonnet 5.5 vs Opus 5.5: quanto custa realmente cada turno no Claude Code

Um turno curto de um subagente de Claude Code custa cerca de um décimo de centavo com Claude Haiku 5.5 e quase dois centavos com Sonnet 5.5. Em um turno longo da sessão principal, essa diferença cai de cerca de 17 vezes para cerca de 3 vezes. Nessa diferença está toda a decisão: Haiku 5.5 é um modelo para subagentes, e usá-lo como um modelo principal mais barato desperdiça quase toda a economia.

O que é Claude Haiku 5.5?

Claude Haiku 5.5 é o modelo pequeno e rápido da Anthropic, lançado em 7 de outubro de 2026. A Anthropic o posiciona para trabalho de alto volume e sensível a custos: resumos, compactação, classificação, uso do navegador e, o que mais importa aqui, funcionar como subagente de Opus 5.5 ou Sonnet 5.5 em tarefas de programação.

O ID do modelo é claude-haiku-5-5. Tem janela de contexto de 1M de tokens, saída máxima de 128K e conhecimento até junho de 2026. É o primeiro Haiku com nível de esforço ajustável, e por padrão usa medium. Conforme a Anthropic, está disponível em todas as suas plataformas, incluindo AWS, Google Cloud e Microsoft Azure.

A Anthropic é inusitadamente direta sobre seu limite. No Terminal-Bench 4.0, seu benchmark de agentic coding, Haiku 5.5 obtém 39,2 por cento frente aos 70,6 por cento de Sonnet 5.5, e o anúncio diz que Sonnet e Opus “remain better choices for complex agentic coding”. Todas as cifras de benchmarks são reportadas pela Anthropic.

Benchmark Haiku 5.5 Sonnet 5.5 Haiku 4.5
Terminal-Bench 4.0 39,2 % 70,6 % 0,0 %
FrontierCode 1.1 (Main) 46,4 % 52,1 % (Xhigh) —
OSWorld 2.1 (subconjunto offline) 72,4 % 83,9 % 15,7 %

Qual é o preço de Claude Haiku 5.5 em relação a Sonnet 5.5 e Opus 5.5?

Com prompts curtos, o input de Haiku 5.5 custa a vigésima parte do de Sonnet 5.5. Preços de lista da API da Anthropic, por milhão de tokens (claude haiku 5.5 pricing):

Haiku 5.5 (prompt ≤100K) Haiku 5.5 (prompt >100K) Sonnet 5.5 Opus 5.5
Input $0,10 $0,50 $2 $4
Output $0,50 $2,50 $10 $20
Leitura de cache $0,01 $0,05 $0,10 $0,20
Escrita de cache (5 min) $0,125 $0,625 $2,50 $5

Dois detalhes pesam mais que o destaque.

O limite de 100K. Haiku 5.5 é o único modelo atual de Claude com preço de acordo com o comprimento do prompt. Acima de 100K tokens, cada linha custa cinco vezes mais. A Anthropic diz que prompts de até 100K eram cerca de 90 por cento das solicitações ao Haiku anterior, e daí sai o “cerca de 75 por cento menos” em média. Essa média é da Anthropic e já inclui que o novo tokenizador de Haiku 5.5 usa um pouco mais de tokens por tarefa. Não é uma economia medida sobre sua carga de trabalho.

Sonnet 5.5 também reduziu o preço no mesmo dia. A Anthropic reduziu pela metade a leitura de cache de Sonnet 5.5, de $0,20 para $0,10. Opus 5.5 continua em $0,20. Em 8 de outubro de 2026, esses são os preços de lista. Esta série já teve mudanças de preço com dez dias de diferença, então verifique-os antes de montar um orçamento sobre eles.

Quanto custa Claude Code por turno com Haiku, Sonnet ou Opus?

Depende quase inteiramente de quanto contexto o turno carrega. Dois turnos ilustrativos, com minha aritmética sobre preços de lista e sem contar escritas de cache.

Um turno curto de subagente: 30K tokens lidos de cache, 3K de input novo e 1K de output. O prompt tem 33K, então Haiku fica em sua faixa barata.

Haiku 5.5 Sonnet 5.5 Opus 5.5
~$0,0011 ~$0,019 ~$0,038

Um turno longo da sessão principal: 100K em cache, 5K de input novo e 2K de output. O prompt tem 105K, então Haiku passa para a faixa cara.

Haiku 5.5 Sonnet 5.5 Opus 5.5
~$0,0125 ~$0,040 ~$0,080

Haiku é cerca de 17 vezes mais barato que Sonnet no primeiro turno e cerca de 3 vezes no segundo. Minha leitura é que os tokens em cache contam para o limite de 100K, porque a Anthropic define o preço pelo comprimento do prompt. Verifique o consumo da primeira semana antes de se apoiar nisso.

Por isso o enfoque de subagentes se sustenta. Um subagente de Claude Code começa com um contexto novo: seu próprio system prompt, a tarefa que Claude delega, seus arquivos CLAUDE.md e um snapshot do git status. Não carrega o histórico de sua conversa, e o agente Explore integrado nem mesmo carrega CLAUDE.md ou git status. Os prompts dos subagentes começam pequenos e ficam na faixa de até 100K, exatamente onde a vantagem de preço de Haiku é maior.

Quando faz sentido Claude Haiku 5.5 em vez de Sonnet 5.5?

Na comparação Haiku vs Sonnet, Haiku 5.5 ganha quando a tarefa é bem definida, sobretudo leitura e fácil de verificar. Sonnet 5.5 ou Opus 5.5 continuam sendo a escolha quando a tarefa exige julgamento.

  • Terreno de Haiku 5.5: busca e exploração de código, resumos de logs ou saída de testes, executar a suite de testes e relatar apenas as falhas, extrair um dado de um arquivo grande, classificar ou fazer triagem de issues. Os próprios exemplos da Anthropic têm essa forma: compactação, resumos e trabalho de subagente.
  • Terreno de Sonnet 5.5 ou Opus 5.5: qualquer coisa que escreva código não trivial, debugging sem uma reprodução conhecida, decisões de arquitetura e mudanças em vários arquivos. Um 39 por cento no Terminal-Bench é um sinal claro para não dar o teclado a Haiku.

Os depoimentos de clientes apontam na mesma direção, embora publicados pela própria Anthropic. A Cognition conta que Haiku 5.5 já é uma opção de modelo acompanhante em Devin Fusion, com Opus 5.5 como modelo principal. A Rogo descreve um modelo maior montando o entregável enquanto um subagente Haiku tira uma só linha de um 10-K. O padrão: o modelo principal decide e Haiku busca.

Como usar Haiku 5.5 nos subagentes de Claude Code?

Primeiro atualize. A documentação de Claude Code pede usar v2.1.293 ou superior com Haiku 5.5, que é também a versão em que o alias haiku começa a apontar para Haiku 5.5 na API da Anthropic.

claude update

Há três formas de enviar trabalho, da mais bem definida para a mais ampla. Se os Claude Code subagents são novidade para você, comece por nosso guia de sub-agentes em Claude Code.

1. Por subagente. É a opção por que eu começaria. Defina model: haiku no frontmatter de um subagente próprio. Os arquivos de subagentes ficam em .claude/agents/ (por projeto, para versioná-los com o repo) ou em ~/.claude/agents/ (para todos seus projetos):

---
name: log-summarizer
description: Summarizes test and build output, reporting only failures. Use proactively after running tests.
tools: Read, Grep, Glob, Bash
model: haiku
---

Summarize the output you are given. Report only failing tests with their error messages.

O mesmo frontmatter aceita um campo effort se quiser que Haiku trabalhe abaixo ou acima de seu medium padrão.

2. Substitua o agente Explore integrado. Por padrão, Explore usa o modelo de sua conversa principal, então em uma sessão com Opus suas buscas no código rodam sobre Opus. Conforme a documentação, um subagente de usuário ou de projeto chamado Explore substitui o integrado, mantém seu próprio campo model e você pode defini-lo com model: haiku. Sua definição também substitui o system prompt integrado, então escreva um e dê a ele ferramentas de só leitura.

3. Um modelo padrão para todos os subagentes. CLAUDE_CODE_SUBAGENT_MODEL define o modelo dos subagentes que não têm um atribuído de outra forma. Se o combinar com CLAUDE_CODE_SUBAGENT_MODEL_FORCE (v2.1.257 ou superior), ele se impõe a todos, Explore incluído:

{
  "env": {
    "CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
    "CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
  }
}

Eu não usaria a versão forçada. Ela também coloca Haiku no subagente geral, e esse agente edita código.

Execute /tasks enquanto um subagente trabalha para confirmar qual modelo está usando de verdade. Se quiser testar Haiku como modelo principal, /model claude-haiku-5-5 funciona, mas espere o preço de sessão longa da tabela anterior.

Em um plano Pro ou Max, as solicitações dos subagentes contam para os mesmos limites de uso de sua conversa principal. As cifras em dólares deste artigo são preços de lista da API. No momento da publicação desta nota, não encontrei documentação da Anthropic sobre quanto consome cada modelo dos limites do plano.

O alias haiku aponta para Haiku 5.5 em Bedrock, Google Cloud ou Azure?

Não, ainda não. Em 8 de outubro de 2026, a documentação de Claude Code atribui haiku a Haiku 5.5 apenas na API da Anthropic. No Amazon Bedrock, Google Cloud’s Agent Platform, Microsoft Foundry e Claude Platform on AWS ele continua apontando para Haiku 4.5. Um subagente com model: haiku nesses provedores roda o modelo anterior ao preço anterior.

Aí, defina o modelo explicitamente com ANTHROPIC_DEFAULT_HAIKU_MODEL, usando o ID de Haiku 5.5 de seu provedor. A mesma variável controla o modelo que Claude Code usa para suas tarefas em segundo plano.

O que muda para um time técnico?

Haiku 5.5 não barateia seu modelo principal. O que faz é que delegar fica barato o suficiente para que a pergunta mude de “qual modelo usamos?” para “que trabalho sai do modelo principal?”. Isso é uma política de roteamento, e políticas de roteamento vão no controle de versões. Um diretório .claude/agents/ com alguns subagentes Haiku para busca, resumos e triagem de testes é uma política que todo o time herda com um git pull.

A parte alta da pilha não muda: Opus para o trabalho ambíguo, Sonnet para a implementação bem definida. Haiku adiciona um terceiro nível abaixo, para o trabalho que nunca justificou os tokens de um modelo frontier.

Uma mudança relacionada: a Anthropic diz que esta semana começa a entregar um crédito mensal de API aos inscritos de Claude Max e Team, de $100 em Max 5x, $200 em Max 20x e até $500 compartilhados em Team. É suficiente para medir esses números sobre suas próprias cargas de trabalho antes de definir uma política.


E você? Qual tarefa de Claude Code passaria primeiro para Haiku 5.5?

Onde você usaria Haiku 5.5 em sua configuração de Claude Code?
  • Subagentes de busca e exploração
  • Resumos de testes e logs
  • Em nenhum lugar, fico com Sonnet ou Opus
  • Prefiro outra opção (conte-nos qual)
0 votantes

Comente abaixo ou, se este artigo chegou para você por email, responda diretamente ao email: sua resposta é publicada aqui.

Relacionado: Claude Sonnet 5.5 vs Opus 5.5: em Claude Code, escolher modelo já é uma decisão de custos