Mythos para Todos: Qué Significa Fable 5 para tu Stack (y Cuánto te Va a Costar)

Anthropic lanzó Claude Fable 5, y el encuadre importa más que los números de benchmark. Es el primer modelo de acceso público de la clase Mythos — el mismo tier que Mythos Preview, el modelo que Anthropic mantuvo bajo llave dentro de Project Glasswing desde abril porque su capacidad de encontrar y explotar vulnerabilidades de seguridad se consideraba demasiado peligrosa para liberarla de forma amplia. Fable 5 es esa capacidad, envuelta en nuevos safeguards que la hacen lo bastante segura como para ponerla en manos del resto de nosotros.

Así que el titular no es “Anthropic sacó un modelo mejor”. Es: el modelo más potente al que podés acceder hoy tiene áreas en las que se va a negar deliberadamente a entrar. Y para cualquiera que tome decisiones de stack, esa letra chica es toda la historia.

Qué estás recibiendo en realidad

Fable 5 es state-of-the-art en casi todos los benchmarks que probó Anthropic — software engineering, knowledge work, visión, análisis de datos complejos. En algunos benchmarks puntúa más de un 10% por encima de Opus 4.8. La capacidad que más importa para nuestro mundo, sin embargo, no es un solo número: es la duración. Fable 5 puede trabajar de forma autónoma durante más tiempo que cualquier modelo Claude anterior. Esa es la diferencia entre un asistente que te ayuda a escribir una función y un agente que puede correr una migración de varios días, llevar el control de su propio contexto a lo largo del trabajo y no perder el hilo a mitad de camino.

Si estás construyendo agentes que operan durante días — migraciones, refactors grandes, expandir la cobertura de tests en todo un codebase — este es el primer modelo donde “dejalo correr” deja de ser aspiracional.

La letra chica: hacia dónde no va Fable 5

Acá está la parte que los comunicados de prensa entierran. Fable 5 viene con classifiers que detectan requests de alto riesgo y los redirigen silenciosamente a Opus 4.8. Las áreas cubiertas son ciberseguridad, biología y química, y distillation (terceros que intentan extraer las capacidades del modelo). Preguntale algo que dispare un classifier — y el ejemplo canónico que da Anthropic es “cómo fabricar ricina” — y no recibís una respuesta de clase Mythos. Recibís una respuesta de Opus 4.8.

Anthropic dice que esto afecta a menos del 5% de las sesiones en promedio. Para la mayoría de los que construimos tooling de desarrollo, ese 5% nunca aparece. Pero si tu trabajo está cerca de la investigación en seguridad, ese límite no es teórico — es exactamente la cosa para la que recurrirías a Fable 5. Vale la pena saberlo antes de cablearlo a un pipeline y descubrir el techo a mitad de la tarea.

Un detalle que valoro, para los que construyen sobre la API: una negativa devuelve stop_reason: "refusal" como un HTTP 200, y no te cobran si no se genera output. Así que el fallback es al menos observable y gratuito — podés detectarlo en tu propio código y rutear alrededor de él.

El costo, y la ventana rara

Fable 5 lista a 10 dólares por millón de tokens de input y 50 por millón de output, con hasta 128k tokens de salida. Eso es aproximadamente el doble que Opus 4.8. El salto de capacidad puede justificarlo para trabajo agéntico de larga duración donde de otro modo quemarías más tokens haciéndole de niñera a un modelo más débil — pero “el doble de precio” es una línea real en el presupuesto, no un error de redondeo, y la eficiencia de tokens del nuevo modelo todavía es una pregunta abierta.

Después está el rollout, que es genuinamente raro. Fable 5 es gratis en los planes Pro, Max, Team y Enterprise por asiento desde el lanzamiento hasta el 22 de junio. El 23 de junio sale de esos planes, y usarlo requiere créditos de uso. Anthropic dice que va a reincorporar el modelo a las suscripciones una vez que tenga suficiente capacidad. En la API y en Enterprise por consumo está disponible ahora, sin ventana.

Leé ese calendario con honestidad: tenés dos semanas de pista para evaluar Fable 5 sobre tus workloads reales sin costo marginal. Después de eso, es una decisión de créditos. Si vas a probarlo, probalo ahora — no por el hype, sino porque la ventana de evaluación gratuita tiene fecha de vencimiento dura.

Entonces: ¿herramienta de producción o experimento caro?

Para mí la decisión se parte limpiamente. Si estás corriendo trabajo agéntico de horizonte largo — migraciones de varios días, refactors autónomos, cualquier cosa donde la persistencia de contexto en el tiempo sea el cuello de botella — Fable 5 es el primer modelo que vuelve creíbles esos workflows, y la ventana gratuita de dos semanas es un regalo que no deberías desperdiciar. Si tu trabajo vive en los dominios bloqueados, el fallback a Opus 4.8 significa que estás pagando precios de Fable 5 por respuestas de Opus 4.8 justo en los momentos en que querrías el upgrade. Y si estás haciendo coding ordinario del día a día, Opus 4.8 sigue siendo excelente y bastante más barato — el salto puede no pagarse solo todavía.

Lo interesante de Fable 5 no es que sea potente. Es que Anthropic decidió que la capacidad era lo suficientemente peligrosa como para ponerle compuertas, y después encontró la manera de lanzarlo igual con las partes peligrosas tapiadas. Esa es una nueva forma de decisión de producto, y vale la pena observar si se convierte en la norma.

¿Vos ya estás probando Fable 5 en algún workload real, o estás esperando a ver cómo se comporta el fallback antes de meterlo en tu pipeline?

Mythos para Todos: Qué Significa Fable 5 para tu Stack (y Cuánto te Va a Costar)

Me pasé los últimos meses diciéndoles a los equipos que Opus 4.8 era el techo para cualquier cosa que de verdad fueras a poner en producción. Desde el 9 de junio, eso dejó de ser cierto — y el modelo que lo reemplazó en la cima viene con una letra chica lo suficientemente grande como para cambiar la forma en que lo pensás.

Anthropic lanzó Claude Fable 5, y el encuadre importa más que los números de benchmark. Es el primer modelo de acceso público de la clase Mythos — el mismo tier que Mythos Preview, el modelo que Anthropic mantuvo bajo llave dentro de Project Glasswing desde abril porque su capacidad de encontrar y explotar vulnerabilidades de seguridad se consideraba demasiado peligrosa para liberarla de forma amplia. Fable 5 es esa capacidad, envuelta en nuevos safeguards que la hacen lo bastante segura como para ponerla en manos del resto de nosotros.

Así que el titular no es “Anthropic sacó un modelo mejor”. Es: el modelo más potente al que podés acceder hoy tiene áreas en las que se va a negar deliberadamente a entrar. Y para cualquiera que tome decisiones de stack, esa letra chica es toda la historia.

Qué estás recibiendo en realidad

Fable 5 es state-of-the-art en casi todos los benchmarks que probó Anthropic — software engineering, knowledge work, visión, análisis de datos complejos. En algunos benchmarks puntúa más de un 10% por encima de Opus 4.8. La capacidad que más importa para nuestro mundo, sin embargo, no es un solo número: es la duración. Fable 5 puede trabajar de forma autónoma durante más tiempo que cualquier modelo Claude anterior. Esa es la diferencia entre un asistente que te ayuda a escribir una función y un agente que puede correr una migración de varios días, llevar el control de su propio contexto a lo largo del trabajo y no perder el hilo a mitad de camino.

Si estás construyendo agentes que operan durante días — migraciones, refactors grandes, expandir la cobertura de tests en todo un codebase — este es el primer modelo donde “dejalo correr” deja de ser aspiracional.

La letra chica: hacia dónde no va Fable 5

Acá está la parte que los comunicados de prensa entierran. Fable 5 viene con classifiers que detectan requests de alto riesgo y los redirigen silenciosamente a Opus 4.8. Las áreas cubiertas son ciberseguridad, biología y química, y distillation (terceros que intentan extraer las capacidades del modelo). Preguntale algo que dispare un classifier — y el ejemplo canónico que da Anthropic es “cómo fabricar ricina” — y no recibís una respuesta de clase Mythos. Recibís una respuesta de Opus 4.8.

Anthropic dice que esto afecta a menos del 5% de las sesiones en promedio. Para la mayoría de los que construimos tooling de desarrollo, ese 5% nunca aparece. Pero si tu trabajo está cerca de la investigación en seguridad, ese límite no es teórico — es exactamente la cosa para la que recurrirías a Fable 5. Vale la pena saberlo antes de cablearlo a un pipeline y descubrir el techo a mitad de la tarea.

Un detalle que valoro, para los que construyen sobre la API: una negativa devuelve stop_reason: "refusal" como un HTTP 200, y no te cobran si no se genera output. Así que el fallback es al menos observable y gratuito — podés detectarlo en tu propio código y rutear alrededor de él.

El costo, y la ventana rara

Fable 5 lista a 10 dólares por millón de tokens de input y 50 por millón de output, con hasta 128k tokens de salida. Eso es aproximadamente el doble que Opus 4.8. El salto de capacidad puede justificarlo para trabajo agéntico de larga duración donde de otro modo quemarías más tokens haciéndole de niñera a un modelo más débil — pero “el doble de precio” es una línea real en el presupuesto, no un error de redondeo, y la eficiencia de tokens del nuevo modelo todavía es una pregunta abierta.

Después está el rollout, que es genuinamente raro. Fable 5 es gratis en los planes Pro, Max, Team y Enterprise por asiento desde el lanzamiento hasta el 22 de junio. El 23 de junio sale de esos planes, y usarlo requiere créditos de uso. Anthropic dice que va a reincorporar el modelo a las suscripciones una vez que tenga suficiente capacidad. En la API y en Enterprise por consumo está disponible ahora, sin ventana.

Leé ese calendario con honestidad: tenés dos semanas de pista para evaluar Fable 5 sobre tus workloads reales sin costo marginal. Después de eso, es una decisión de créditos. Si vas a probarlo, probalo ahora — no por el hype, sino porque la ventana de evaluación gratuita tiene fecha de vencimiento dura.

Entonces: ¿herramienta de producción o experimento caro?

Para mí la decisión se parte limpiamente. Si estás corriendo trabajo agéntico de horizonte largo — migraciones de varios días, refactors autónomos, cualquier cosa donde la persistencia de contexto en el tiempo sea el cuello de botella — Fable 5 es el primer modelo que vuelve creíbles esos workflows, y la ventana gratuita de dos semanas es un regalo que no deberías desperdiciar. Si tu trabajo vive en los dominios bloqueados, el fallback a Opus 4.8 significa que estás pagando precios de Fable 5 por respuestas de Opus 4.8 justo en los momentos en que querrías el upgrade. Y si estás haciendo coding ordinario del día a día, Opus 4.8 sigue siendo excelente y bastante más barato — el salto puede no pagarse solo todavía.

Lo interesante de Fable 5 no es que sea potente. Es que Anthropic decidió que la capacidad era lo suficientemente peligrosa como para ponerle compuertas, y después encontró la manera de lanzarlo igual con las partes peligrosas tapiadas. Esa es una nueva forma de decisión de producto, y vale la pena observar si se convierte en la norma.

¿Vos ya estás probando Fable 5 en algún workload real, o estás esperando a ver cómo se comporta el fallback antes de meterlo en tu pipeline?