Qué es Muse Spark 1.3 y cuánto cuesta frente a Claude Code


Muse Spark es el modelo de Meta para tareas de código y agentes, y su versión 1.3 hace el mismo trabajo con un 25% menos de tokens que la 1.2. Se publicó el 2 de septiembre de 2026 y llegó ese mismo día a Muse Code, el agente de terminal de Meta, que dos días antes había salido de beta con planes desde 5 dólares al mes.

Conviene separar dos afirmaciones que suelen mezclarse. La cifra del 25% —y la del 20% menos de llamadas a herramientas— sale de comparaciones internas de los propios ingenieros de Meta contra Muse Spark 1.2. No es un benchmark independiente ni forma parte de la tabla de resultados publicada. Meta sí publicó una tabla, aparte, con once benchmarks, y esa tabla tiene un detalle importante que revisamos más abajo.

¿Qué es Muse Spark?

Muse Spark es la familia de modelos de Meta Superintelligence Labs orientada a programación, razonamiento y trabajo agéntico. Es el motor, no la herramienta: lo que usas en el día a día es Muse Code, y Muse Spark es el modelo que corre por debajo. También está disponible directamente a través de Meta Model API.

¿Y qué es Muse Code?

Muse Code es el agente de código de Meta que corre en la terminal. Lo instalas en tu máquina, lo apuntas a un repositorio y trabajas conversando con él, igual que harías con cualquier otro agente de línea de comandos.

La distinción importa esta semana porque las dos piezas se movieron a la vez: Muse Code salió de beta el 31 de agosto y el modelo subió de versión el 2 de septiembre. Muse Code es público desde principios de agosto, así que la herramienta no es nueva; lo nuevo es que Meta ya la trata como producto terminado y no como preview.

Al salir de beta sumó cuatro cosas que cambian bastante el flujo de trabajo:

  • Mensajería entre sesiones. Dos sesiones de Muse Code pueden mandarse mensajes. Si una cambia algo de lo que otra depende, le pasa el aviso; si una resuelve una duda que tenía bloqueada a la otra, le manda la respuesta. Los mensajes viajan por un socket Unix entre procesos tuyos, así que nada sale a la red. El agente descubre a sus pares y escribe el mensaje por su cuenta.
  • Workflows. Escribes “use a workflow” y Muse Code orquesta un equipo de subagentes en paralelo sobre una misma tarea. En /workflows ves el progreso en vivo y puedes parar, reiniciar o cancelar. Los workflows que te sirven se guardan y se reutilizan.
  • Rewind. Doble Esc y vuelves a un punto anterior de la conversación. Muse Code solo ofrece puntos de retorno que considera seguros según su registro de eventos, y te pide confirmación antes de deshacer trabajo.
  • SDK en preview. El motor del CLI —sesiones, herramientas, control de permisos— como librería de TypeScript. Tu programa levanta un host muse local y habla con él por el Muse Session Protocol sobre entrada y salida estándar: sin servidor y sin red.

¿Qué cambia en Muse Spark 1.3?

Tres cosas, en orden de cuánto las vas a notar.

Cuesta menos correr la misma tarea. Menos llamadas a herramientas, menos tokens y menos turnos donde no hacían falta. Meta describe el estilo de código como más limpio y menos verboso, y ese es el mecanismo detrás del número, no una afirmación separada.

Pregunta en vez de adivinar. Meta entrenó la 1.3 para hacer preguntas cuando el prompt es ambiguo, pedir ayuda cuando se queda trabada y confirmar antes de acciones consecuentes. En tareas largas se adapta a si prefieres actualizaciones frecuentes o que trabaje en silencio. Es un cambio de usabilidad más que de capacidad, y es de los que se notan en el primer día de uso.

Sabe lo que no sabe. Según Meta, el modelo fue entrenado para reconocer cuándo choca contra un muro en lugar de alucinar un resultado, y para sostener requisitos detallados a lo largo de tareas de varios pasos sin ir soltando restricciones por el camino.

En seguridad, Meta declara mejor resistencia a inyecciones de prompt y mejor criterio sobre qué cuenta como acción irreversible. Ambas son caracterizaciones del propio fabricante.

¿Cuánto cuesta frente a Claude Code?

Muse Code tiene tres planes mensuales, publicados el 31 de agosto, que Meta posiciona como más baratos que pagar por uso en Meta Model API:

Plan Precio Para qué
Everyday Usage 5,00 USD/mes 10–50 peticiones cada 5 horas, subida de imagen y video, modo voz, búsqueda web
High Usage 15,00 USD/mes 3x el cupo de Everyday, más entradas multimodales, acceso a los modelos más recientes
Power Usage 50,00 USD/mes 10x el cupo de Everyday, subidas de archivo mayores, acceso anticipado a novedades

Del otro lado, los planes de Claude son Free a 0 dólares, Pro a 17 dólares al mes con pago anual (20 si pagas mes a mes) y Max desde 100 dólares al mes. El detalle que importa para esta comparación: Claude Code no está incluido en el plan Free. Aparece a partir de Pro, y Max añade 5x o 20x más uso que Pro.

Así que la lectura honesta de precios es esta. La entrada más barata a un agente de código es Muse Code a 5 dólares, por debajo de los 17 de Claude Pro. Pero ninguno de los dos tiene un nivel gratuito real para trabajo agéntico, y los cupos no son comparables entre sí: Meta cuenta peticiones por ventana de cinco horas y Anthropic no publica su cupo en las mismas unidades. Comparar 5 contra 17 dólares sin más es engañoso.

Y hay un detalle que conviene revisar antes de suscribirte. En la página de planes de Meta del 31 de agosto de 2026 —publicada dos días antes de que saliera Muse Spark 1.3— los tres niveles describen su acceso al modelo en términos de Muse Spark 1.2: “Access to Muse Spark 1.2” en Everyday, “More Muse Spark 1.2 usage” en High y “Expanded Muse Spark 1.2 usage” en Power. Solo High y Power prometen además “acceso a los modelos más recientes”. Al momento de publicar esta nota, el 3 de septiembre de 2026, Meta no había actualizado esa página para mencionar la 1.3 ni había aclarado si el nivel de 5 dólares la incluye. Si te suscribes específicamente por las mejoras de eficiencia que describimos aquí, el plan de 15 dólares es el único cuya redacción las cubre sin ambigüedad.

¿Cómo se instala Muse Code?

Un solo comando, en macOS o Linux, tal como lo publica Meta:

curl -fsSL https://dev.meta.ai/install.sh | bash

Después inicias sesión con tu cuenta de Meta Model API. No hay ruta de instalación para Windows en las instrucciones de Meta: el comando documentado cubre macOS y Linux únicamente. Si trabajas en Windows, WSL es la solución evidente, pero Meta no la documenta, así que trátala como configuración propia y no como camino soportado.

¿Qué dicen los benchmarks de Meta?

Meta publicó su propia tabla comparativa, así que vale la pena leerla con las advertencias por delante. Son benchmarks elegidos por el fabricante y ejecutados por el fabricante, y comparan Muse Spark 1.3 en razonamiento máximo contra Opus 5 y GPT 5.6 Sol también en máximo. Muse Spark 1.2 aparece en xhigh, un nivel más bajo, lo que favorece el salto generacional.

Benchmark Muse Spark 1.3 (max) 1.2 (xhigh) GPT 5.6 Sol (max) Opus 5 (max)
GDPVal-AA v2 1754 1615 1710 1824
JobBench 64,9 61,6 45,4 65,7
OSWorld 2.0 (parcial/binario) 66,9 / 32,0 47,6 / 17,9 62,7 / 27,3 68,3 / 31,4
DeepSearchQA 89,4 85,9 93,0 90,4
Agentic IF Index (interno) 57,8 46,2 60,5 59,1
AutomationBench 49,4 38,2 46,7 50,3
MRCR 256K–512K 98,5 66,3 91,5
MRCR 512K–1M 98,1 55,5 73,8
DeepSWE v1.1 75,4 55,0 73,0 74,0
SWEAtlas CodeBase QnA 59,4 46,2 53,5 52,7
Terminal-Bench 2.1 88,8 82,9 88,8 86,7

En trabajo agéntico, Meta pierde su propia tabla. Opus 5 lidera en trabajo de conocimiento, uso profesional de herramientas, uso de computadora y flujos de negocio de punta a punta. GPT 5.6 Sol lidera en navegación agéntica y seguimiento de instrucciones. Muse Spark 1.3 se lleva el puntaje binario de OSWorld 2.0 por seis décimas y poco más.

En código y contexto largo la foto se invierte, y ahí es donde vive el argumento de este artículo. La 1.3 lidera las tres filas de código y las dos de contexto largo, con 98,5 y 98,1 en MRCR frente a 91,5 y 73,8 de GPT 5.6 Sol. Anthropic no reportó MRCR, así que esas dos filas no tienen comparación con Opus 5.

El resumen honesto es más estrecho que “Meta gana” o “Meta pierde”: con sus propios números, Meta construyó un modelo mejor leyendo un codebase grande y trabajando en la terminal que operando una computadora o navegando la web. Si tu trabajo es lo primero, ese es el hallazgo relevante. Si es lo segundo, la tabla dice que compres otra cosa, y quien lo dice es Meta.

¿Qué todavía no está disponible?

El modo de razonamiento máximo. El anuncio de Meta dice que los modos de razonamiento previos funcionan hoy y que el máximo llega “poco después de terminar pruebas de seguridad adicionales”. Al momento de publicar esta nota, el 3 de septiembre de 2026, Meta no había dado fecha.

Y aquí está el detalle prometido sobre la tabla: la columna de Muse Spark 1.3 dice (max). Todos los números que Meta publicó para la 1.3 salen precisamente del modo que todavía no puedes usar. No son los resultados del modelo que se instala hoy.

La publicación de pesos abiertos de Muse Spark también está anunciada sin calendario. Si lees esto semanas después, ambas cosas merecen una revisión.

¿Conviene cambiarse?

Depende de dónde esté tu cuenta, no de qué modelo puntúa mejor. Las formas de las dos herramientas convergieron: las dos son agentes de terminal, las dos orquestan subagentes en paralelo, las dos traen SDK y las dos venden suscripción además del uso por API. El único diferenciador real de Muse Code hoy es la mensajería entre sesiones sobre socket local; varias sesiones coordinándose sin que tú hagas de mensajero entre terminales no es algo que las alternativas documenten.

Si ya trabajas sobre Meta Model API, la 1.3 es una mejora gratis que abarata cada tarea. Si no, la instalación es un comando y evaluarla te cuesta una tarde. Lo que no deberías hacer es decidir con la tabla de benchmarks en la mano, porque esa tabla describe un modo que Meta todavía no entregó.

Si te interesa el resto de la familia, cubrimos el modelo abierto de Meta en Meta dice 3.1x pero no dice de cuánto: corriendo Muse Glimmer 30B local con llama.cpp. Y sobre cómo el precio por tarea cambia la decisión de modelo, revisa Casi Fable 5 a mitad de precio: por qué Opus 5 cambia tu decisión de modelo.