Claude Haiku 5.5 vs Sonnet 5.5 vs Opus 5.5: cuánto cuesta realmente cada turno en Claude Code

Un turno corto de un subagente de Claude Code cuesta alrededor de una décima de centavo con Claude Haiku 5.5 y casi dos centavos con Sonnet 5.5. En un turno largo de la sesión principal, esa brecha baja de unas 17 veces a unas 3. En esa diferencia está toda la decisión: Haiku 5.5 es un modelo para subagentes, y usarlo como un modelo principal más barato desperdicia casi todo el ahorro.

¿Qué es Claude Haiku 5.5?

Claude Haiku 5.5 es el modelo pequeño y rápido de Anthropic, lanzado el 7 de octubre de 2026. Anthropic lo posiciona para trabajo de alto volumen y sensible al costo: resúmenes, compactación, clasificación, uso del navegador y, lo que más importa aquí, funcionar como subagente de Opus 5.5 o Sonnet 5.5 en tareas de programación.

El ID del modelo es claude-haiku-5-5. Tiene ventana de contexto de 1M de tokens, salida máxima de 128K y conocimiento hasta junio de 2026. Es el primer Haiku con nivel de esfuerzo ajustable, y por defecto usa medium. Según Anthropic, está disponible en todas sus plataformas, incluidas AWS, Google Cloud y Microsoft Azure.

Anthropic es inusualmente directa sobre su techo. En Terminal-Bench 4.0, su benchmark de agentic coding, Haiku 5.5 obtiene 39,2 por ciento frente al 70,6 por ciento de Sonnet 5.5, y el anuncio dice que Sonnet y Opus “remain better choices for complex agentic coding”. Todas las cifras de benchmarks son reportadas por Anthropic.

Benchmark Haiku 5.5 Sonnet 5.5 Haiku 4.5
Terminal-Bench 4.0 39,2 % 70,6 % 0,0 %
FrontierCode 1.1 (Main) 46,4 % 52,1 % (Xhigh) —
OSWorld 2.1 (subconjunto offline) 72,4 % 83,9 % 15,7 %

¿Cuál es el precio de Claude Haiku 5.5 frente a Sonnet 5.5 y Opus 5.5?

Con prompts cortos, el input de Haiku 5.5 cuesta la vigésima parte que el de Sonnet 5.5. Precios de lista de la API de Anthropic, por millón de tokens (claude haiku 5.5 pricing):

Haiku 5.5 (prompt ≤100K) Haiku 5.5 (prompt >100K) Sonnet 5.5 Opus 5.5
Input $0,10 $0,50 $2 $4
Output $0,50 $2,50 $10 $20
Lectura de caché $0,01 $0,05 $0,10 $0,20
Escritura en caché (5 min) $0,125 $0,625 $2,50 $5

Dos detalles pesan más que el titular.

El umbral de 100K. Haiku 5.5 es el único modelo actual de Claude con precio según el largo del prompt. Por encima de 100K tokens, cada línea cuesta cinco veces más. Anthropic dice que los prompts de hasta 100K eran cerca del 90 por ciento de las solicitudes al Haiku anterior, y de ahí sale su “alrededor de 75 por ciento menos” en promedio. Ese promedio es de Anthropic y ya incluye que el nuevo tokenizador de Haiku 5.5 usa algo más de tokens por tarea. No es un ahorro medido sobre tu carga de trabajo.

Sonnet 5.5 también bajó el mismo día. Anthropic redujo a la mitad la lectura de caché de Sonnet 5.5, de $0,20 a $0,10. Opus 5.5 sigue en $0,20. Al 8 de octubre de 2026 esos son los precios de lista. Esta serie ya tuvo cambios de precio con diez días de diferencia, así que revísalos antes de armar un presupuesto sobre ellos.

¿Cuánto cuesta Claude Code por turno con Haiku, Sonnet u Opus?

Depende casi por completo de cuánto contexto carga el turno. Dos turnos ilustrativos, con mi aritmética sobre precios de lista y sin contar escrituras en caché.

Un turno corto de subagente: 30K tokens leídos de caché, 3K de input nuevo y 1K de output. El prompt es de 33K, así que Haiku se queda en su tramo barato.

Haiku 5.5 Sonnet 5.5 Opus 5.5
~$0,0011 ~$0,019 ~$0,038

Un turno largo de la sesión principal: 100K en caché, 5K de input nuevo y 2K de output. El prompt es de 105K, así que Haiku pasa al tramo caro.

Haiku 5.5 Sonnet 5.5 Opus 5.5
~$0,0125 ~$0,040 ~$0,080

Haiku es unas 17 veces más barato que Sonnet en el primer turno y unas 3 veces en el segundo. Mi lectura es que los tokens en caché cuentan para el umbral de 100K, porque Anthropic define el precio por el largo del prompt. Revisa el consumo de la primera semana antes de apoyarte en eso.

Por eso el enfoque de subagentes se sostiene. Un subagente de Claude Code arranca con un contexto nuevo: su propio system prompt, la tarea que Claude le delega, tus archivos CLAUDE.md y una instantánea del git status. No arrastra el historial de tu conversación, y el agente Explore integrado ni siquiera carga CLAUDE.md ni git status. Los prompts de los subagentes empiezan chicos y se quedan en el tramo de hasta 100K, justo donde la ventaja de precio de Haiku es mayor.

¿Cuándo conviene Claude Haiku 5.5 en vez de Sonnet 5.5?

En la comparación Haiku vs Sonnet, Haiku 5.5 gana cuando la tarea es acotada, sobre todo de lectura y fácil de verificar. Sonnet 5.5 u Opus 5.5 siguen siendo la opción cuando la tarea exige criterio.

  • Terreno de Haiku 5.5: búsqueda y exploración del código, resúmenes de logs o de la salida de tests, correr la suite de tests y reportar solo los fallos, extraer un dato de un archivo grande, clasificar o hacer triage de issues. Los propios ejemplos de Anthropic tienen esa forma: compactación, resúmenes y trabajo de subagente.
  • Terreno de Sonnet 5.5 u Opus 5.5: cualquier cosa que escriba código no trivial, debugging sin una reproducción conocida, decisiones de arquitectura y cambios en varios archivos. Un 39 por ciento en Terminal-Bench es una señal clara para no darle el teclado a Haiku.

Los testimonios de clientes apuntan en la misma dirección, aunque los publicó la propia Anthropic. Cognition cuenta que Haiku 5.5 ya es una opción de modelo acompañante en Devin Fusion, con Opus 5.5 como modelo principal. Rogo describe un modelo más grande armando el entregable mientras un subagente Haiku saca una sola línea de un 10-K. El patrón: el modelo principal decide y Haiku busca.

¿Cómo usar Haiku 5.5 en los subagentes de Claude Code?

Primero actualiza. La documentación de Claude Code pide usar v2.1.293 o superior con Haiku 5.5, que es también la versión en la que el alias haiku empieza a apuntar a Haiku 5.5 en la API de Anthropic.

claude update

Hay tres formas de enviarle trabajo, de la más acotada a la más amplia. Si los Claude Code subagents son nuevos para ti, empieza por nuestra guía de sub-agents en Claude Code.

1. Por subagente. Es la opción por la que yo empezaría. Define model: haiku en el frontmatter de un subagente propio. Los archivos de subagentes van en .claude/agents/ (por proyecto, para versionarlos con el repo) o en ~/.claude/agents/ (para todos tus proyectos):

---
name: log-summarizer
description: Summarizes test and build output, reporting only failures. Use proactively after running tests.
tools: Read, Grep, Glob, Bash
model: haiku
---

Summarize the output you are given. Report only failing tests with their error messages.

El mismo frontmatter acepta un campo effort si quieres que Haiku trabaje por debajo o por encima de su medium por defecto.

2. Reemplaza el agente Explore integrado. Por defecto, Explore usa el modelo de tu conversación principal, así que en una sesión con Opus tus búsquedas en el código corren sobre Opus. Según la documentación, un subagente de usuario o de proyecto llamado Explore reemplaza al integrado, conserva su propio campo model y puedes definirlo con model: haiku. Tu definición también reemplaza el system prompt integrado, así que escribe uno y dale herramientas de solo lectura.

3. Un modelo por defecto para todos los subagentes. CLAUDE_CODE_SUBAGENT_MODEL fija el modelo de los subagentes que no tienen uno asignado de otra forma. Si lo combinas con CLAUDE_CODE_SUBAGENT_MODEL_FORCE (v2.1.257 o superior), se impone a todos, Explore incluido:

{
  "env": {
    "CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
    "CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
  }
}

Yo no usaría la versión forzada. También pone en Haiku al subagente general-purpose, y ese agente edita código.

Ejecuta /tasks mientras un subagente trabaja para confirmar qué modelo está usando de verdad. Si quieres probar Haiku como modelo principal, /model claude-haiku-5-5 funciona, pero espera el precio de sesión larga de la tabla anterior.

En un plan Pro o Max, las solicitudes de los subagentes cuentan para los mismos límites de uso que tu conversación principal. Las cifras en dólares de este artículo son precios de lista de la API. Al momento de publicar esta nota, no encontré documentación de Anthropic sobre cuánto consume cada modelo de los límites del plan.

¿El alias haiku apunta a Haiku 5.5 en Bedrock, Google Cloud o Azure?

No, todavía no. Al 8 de octubre de 2026, la documentación de Claude Code asigna haiku a Haiku 5.5 solo en la API de Anthropic. En Amazon Bedrock, Google Cloud’s Agent Platform, Microsoft Foundry y Claude Platform on AWS sigue apuntando a Haiku 4.5. Un subagente con model: haiku en esos proveedores corre el modelo anterior al precio anterior.

Ahí, fija el modelo de forma explícita con ANTHROPIC_DEFAULT_HAIKU_MODEL, usando el ID de Haiku 5.5 de tu proveedor. La misma variable controla el modelo que Claude Code usa para sus tareas en segundo plano.

¿Qué cambia para un equipo técnico?

Haiku 5.5 no abarata tu modelo principal. Lo que hace es que delegar sea lo bastante barato como para que la pregunta cambie de “¿qué modelo usamos?” a “¿qué trabajo sale del modelo principal?”. Eso es una política de enrutamiento, y las políticas de enrutamiento van en el control de versiones. Un directorio .claude/agents/ con unos pocos subagentes Haiku para búsqueda, resúmenes y triage de tests es una política que todo el equipo hereda con un git pull.

La parte alta del stack no cambia: Opus para el trabajo ambiguo, Sonnet para la implementación bien acotada. Haiku agrega un tercer nivel por debajo, para el trabajo que nunca justificó los tokens de un modelo frontier.

Un cambio relacionado: Anthropic dice que esta semana empieza a entregar un crédito mensual de API a los suscriptores de Claude Max y Team, de $100 en Max 5x, $200 en Max 20x y hasta $500 compartidos en Team. Alcanza para medir estos números sobre tus propias cargas de trabajo antes de fijar una política.


¿Y tú? ¿Qué tarea de Claude Code pasarías primero a Haiku 5.5?

¿Dónde usarías Haiku 5.5 en tu configuración de Claude Code?
  • Subagentes de búsqueda y exploración
  • Resúmenes de tests y logs
  • En ninguno, me quedo con Sonnet u Opus
  • Prefiero otra opción (cuéntanos cuál)
0 votantes

Comenta abajo o, si este artículo te llegó por correo, responde directamente al email: tu respuesta se publica aquí.

Relacionado: Claude Sonnet 5.5 vs Opus 5.5: en Claude Code, elegir modelo ya es una decisión de costos