logo
  • Entornos
  • Empresa
  • Precios
Blogs
Sector|Sep 3, 2026

Muse Spark 1.3: El Modelo Frontier de Meta para Código y Agentes, Explicado

La cuarta versión de Muse Spark de Meta en cinco meses alcanza la frontera — con el mejor benchmark de trabajo agéntico, precios sin cambios y una variante de razonamiento máximo en vista previa limitada.

EigentEigent
Share to
Muse Spark 1.3: El Modelo Frontier de Meta para Código y Agentes, Explicado
  • ¿Qué es Muse Spark 1.3?
  • Las Dos Variantes: xhigh vs max
  • Benchmarks: Donde Muse Spark 1.3 Alcanza la Frontera
  • Las Regresiones que Meta No Destacó
  • Precios: El Modelo Frontier más Económico por Tarea
  • Qué Cambió en Código
  • Cómo se Compara con el Resto del Campo
  • Qué Sigue
  • Conclusión
  • Pon a Trabajar Muse Spark 1.3 en una Fuerza Laboral de IA
  • Preguntas Frecuentes
Automate Everything with
AI Workforce on Desktop
Download Eigent

Muse Spark 1.3 es el nuevo modelo frontier de Meta para código y trabajo agéntico, lanzado el 2 de septiembre de 2026 — el cuarto modelo Muse Spark de Meta en cinco meses. El titular: su variante principal queda justo detrás de Claude en el índice de inteligencia líder, obtiene el puesto #1 en un benchmark clave de trabajo agéntico, y lo hace al menor costo por tarea de cualquier modelo en su categoría. Aquí encontrarás qué cambió respecto a Muse Spark 1.2, las dos variantes, los benchmarks, los precios y dónde encaja para quienes desarrollan agentes.

¿Qué es Muse Spark 1.3?

Muse Spark 1.3 es un modelo de razonamiento de Meta, optimizado para código de largo alcance y flujos de trabajo agénticos. Acepta entrada de texto, imagen y video, tiene una ventana de contexto de 1M de tokens y está disponible en Muse Code y la API de modelos de Meta desde el día de lanzamiento.

El propio enfoque de Meta es que el modelo está diseñado para sostener trabajos más prolongados colaborando con el usuario y gestionando múltiples flujos de trabajo en un solo hilo largo. En la práctica, eso significa hacer preguntas aclaratorias cuando un prompt es ambiguo, solicitar ayuda cuando se queda bloqueado y confirmar antes de realizar acciones con consecuencias — un comportamiento orientado a agentes que operan durante mucho tiempo en lugar de chats de una sola respuesta.

El director de Meta AI, Alexandr Wang, le dijo a Axios que la actualización es "muy competitiva con los modelos frontier" y ayuda a allanar el camino para productos como agentes personales que trabajan en tu nombre. El lanzamiento coincidió con la misma semana que Gemini 3.8 Flash de Google y Claude Fable 5.1 de Anthropic — unos días muy concurridos para lanzamientos de modelos.

Las Dos Variantes: xhigh vs max

Muse Spark 1.3 se lanza como dos modelos con diferentes presupuestos de razonamiento:

  • Muse Spark 1.3 (xhigh) — disponible ahora en Muse Code y la API.
  • Muse Spark 1.3 (max) — una variante de mayor esfuerzo en vista previa limitada para los socios de Meta, con lanzamiento más amplio tras pruebas de seguridad adicionales.

La diferencia está en cuánto razona cada variante. En el Índice de Inteligencia de Artificial Analysis, xhigh obtiene 61 y max obtiene 62. La variante max alcanza sus cifras más altas gastando más — aproximadamente un 62% más de razonamiento en una evaluación agéntica y un 28% más en otra en comparación con xhigh. Si quieres el mejor resultado y puedes asumir el costo en tokens, max es el objetivo; si quieres el mejor equilibrio precio-rendimiento disponible hoy, xhigh es la opción.

Benchmarks: Donde Muse Spark 1.3 Alcanza la Frontera

En el Índice de Inteligencia de Artificial Analysis, Muse Spark 1.3 (xhigh) entra en 61 — 4 puntos más que Muse Spark 1.2 (57) y 8 puntos más que Muse Spark 1.1 (53). Empata con GPT-5.6 Sol (max) y Grok 4.6 (high). La variante max en 62 queda solo detrás de Claude Fable 5.1 y Claude Opus 5 en la cima del índice.

La mayor parte de la mejora proviene de tareas agénticas y científicas, no de conocimiento puro.

BenchmarkMuse Spark 1.21.3 (xhigh)1.3 (max)
Tau3-Bench Banking35%47%52%
Terminal-Bench 2.180%85%86%
GDPval-AA v2 (Elo)1,6151,7091,754
CritPt (científico)18%26%~25%
GPQA Diamond90%94%94%

Fuente: Artificial Analysis, 2 de septiembre de 2026.

El resultado destacado es Tau3-Bench Banking: el 52% de la variante max es la puntuación #1 entre todos los modelos, y el salto de 12 a 17 puntos sobre Muse Spark 1.2 es el principal impulsor de la mejora en el índice. El razonamiento científico aumentó en general, liderado por una ganancia de 8 puntos en CritPt para xhigh.

Las Regresiones que Meta No Destacó

Dos benchmarks retrocedieron respecto a Muse Spark 1.2. Ambas variantes bajaron 4 puntos en AA-LCR (del 83% al 79%), y AA-Omniscience (Accuracy) cayó 3 puntos para xhigh y 1 punto para max. Según Artificial Analysis, la caída en omniscience proviene de una mayor tasa de abstención — el modelo se niega a responder cuando no está seguro — lo que también redujo su tasa de alucinaciones. Eso es posiblemente una ventaja para el trabajo agéntico: un modelo que dice "no sé" en lugar de adivinar con confianza es más seguro para asignarle una tarea larga y con consecuencias.

Meta afirma que entrenó Muse Spark 1.3 para tener un mejor sentido de lo que sabe y lo que no sabe, y para señalar cuándo llega a un límite en lugar de alucinar un resultado — coherente con ese comportamiento de abstención.

Precios: El Modelo Frontier más Económico por Tarea

Los precios no cambian respecto a Muse Spark 1.2: $1.25 por 1M de tokens de entrada y $4.25 por 1M de tokens de salida, con descuentos en caché a $0.15 por 1M. Wang describió los precios como "agresivos".

La comparación que importa es el costo por tarea. Artificial Analysis mide Muse Spark 1.3 (xhigh) en $0.55 por tarea del Índice de Inteligencia — el menor costo de cualquier modelo con puntuación de 59 o superior. Sus competidores directos en 61 cuestan mucho más: Grok 4.6 (high) a $0.94 y GPT-5.6 Sol (max) a $0.95, una prima de más del 70%. Meta aún no ha publicado los precios de la variante max.

Una advertencia: el costo por tarea aumentó respecto a Muse Spark 1.2 ($0.40), porque el nuevo modelo consume aproximadamente un 57% más de tokens de entrada por tarea agéntica. Es más económico que sus competidores, pero no más económico que su predecesor.

Qué Cambió en Código

Meta afirma que Muse Spark 1.3 fue entrenado con más tareas de código de largo alcance y es más utilizable en trabajo de ingeniería real. En comparación con Muse Spark 1.2, realiza menos turnos donde no son necesarios, es menos verboso y tiene un estilo de código más limpio. En las comparaciones internas de ingenieros de Meta, usó aproximadamente un 20% menos de llamadas a herramientas y un 25% menos de tokens — una eficiencia que se acumula a lo largo de una ejecución larga de agente.

Meta también reporta mejoras de seguridad más relevantes para los agentes: mayor resistencia a la inyección de prompts y entradas adversariales, y mejor calibración sobre qué acciones son irreversibles antes de proceder.

Cómo se Compara con el Resto del Campo

Muse Spark 1.3 (xhigh) se entiende mejor como la opción de valor en el límite de la frontera: empatado en el índice con GPT-5.6 Sol (max) y Grok 4.6 (high), liderándolos en costo por tarea y encabezando el campo en tareas agénticas bancarias. Queda por detrás de Claude Fable 5.1 (66) y Claude Opus 5 (63) en el índice general — así que si quieres el modelo más potente sin importar el precio, Claude sigue liderando; si quieres rendimiento agéntico de nivel frontier al menor costo, Muse Spark 1.3 es el destacado.

Para una comparación directa de los lanzamientos de esta semana, consulta nuestra comparación de Muse Spark 1.3 vs Gemini 3.8 Flash vs Claude Fable 5.1.

Qué Sigue

Meta dice que su hoja de ruta incluye modelos más grandes y un lanzamiento de Muse Spark con pesos abiertos. Esto sigue a Muse Glimmer, el modelo de pesos abiertos de 30B destilado de Muse Spark que Meta lanzó en agosto — por lo que la familia de pesos abiertos parece seguir creciendo. Wang también señaló la seguridad como uno de los temas internos más importantes en este momento, indicando que Meta tiene modelos más potentes en desarrollo.

Conclusión

Muse Spark 1.3 es Meta alcanzando la frontera en trabajo agéntico y de código a un precio genuinamente competitivo. La variante xhigh está disponible hoy y ofrece el menor costo por tarea de cualquier modelo en su nivel de inteligencia; la variante max queda justo detrás de Claude en la cima del índice. Los asteriscos honestos: los benchmarks son tempranos, el costo por tarea aumentó respecto a 1.2, y dos evaluaciones retrocedieron ligeramente. Pero si desarrollas agentes y te importa la fiabilidad de largo alcance por dólar, merece estar en tu lista de candidatos.

Pon a Trabajar Muse Spark 1.3 en una Fuerza Laboral de IA

Un modelo frontier como Muse Spark 1.3 solo rinde cuando está conectado a flujos de trabajo reales — herramientas, archivos, revisión de código y planes de múltiples pasos — no en una ventana de chat. Eigent es una aplicación de escritorio Cowork de código abierto que ejecuta una fuerza laboral de agentes de IA localmente y es agnóstica al modelo, por lo que puedes dirigir el modelo adecuado a cada tarea y mantener el trabajo sensible en tu propia máquina. Descubre cómo los agentes pueden revisar PRs de GitHub de principio a fin, luego descarga Eigent para probarlo.

Preguntas Frecuentes

¿Qué es Muse Spark 1.3?

Muse Spark 1.3 es el modelo de razonamiento frontier de Meta para código y trabajo agéntico, lanzado el 2 de septiembre de 2026. Admite entrada de texto, imagen y video con una ventana de contexto de 1M de tokens y está disponible en Muse Code y la API de modelos de Meta. Es el cuarto lanzamiento de Muse Spark de Meta en cinco meses.

¿Cuál es la diferencia entre Muse Spark 1.3 xhigh y max?

Se diferencian por el presupuesto de razonamiento. Muse Spark 1.3 (xhigh) está disponible ahora y obtiene 61 en el Índice de Inteligencia de Artificial Analysis. Muse Spark 1.3 (max) es una variante de mayor esfuerzo en vista previa limitada que obtiene 62 gastando significativamente más tokens de razonamiento, con lanzamiento más amplio tras pruebas de seguridad adicionales.

¿Cuánto cuesta Muse Spark 1.3?

Los precios de la variante xhigh no cambian respecto a Muse Spark 1.2: $1.25 por 1M de tokens de entrada y $4.25 por 1M de tokens de salida, con caché a $0.15 por 1M. Artificial Analysis lo mide en $0.55 por tarea del Índice de Inteligencia — el menor de cualquier modelo con puntuación de 59 o superior. Los precios de la variante max aún no se han anunciado.

¿Es Muse Spark 1.3 mejor que Muse Spark 1.2?

Sí en la mayoría de las tareas. La variante xhigh ganó 4 puntos en el índice y registró grandes saltos en benchmarks agénticos — Tau3-Bench Banking subió del 35% al 47%, Terminal-Bench 2.1 del 80% al 85%. Dos evaluaciones retrocedieron ligeramente (AA-LCR y AA-Omniscience), y el costo por tarea aumentó porque usa más tokens de entrada.

¿Cómo se compara Muse Spark 1.3 con Claude y GPT?

Muse Spark 1.3 (xhigh) empata con GPT-5.6 Sol (max) y Grok 4.6 (high) en 61 en el índice de inteligencia, costando mucho menos por tarea. La variante max en 62 queda solo detrás de Claude Fable 5.1 (66) y Claude Opus 5 (63). Claude sigue liderando en el índice general; Muse Spark lidera en costo por tarea y en la evaluación agéntica Tau3-Bench Banking.

¿Tendrá Muse Spark 1.3 pesos abiertos?

Meta ha dicho que un lanzamiento de Muse Spark con pesos abiertos está en su hoja de ruta, siguiendo el modelo Muse Glimmer de pesos abiertos de 30B que lanzó en agosto. No se ha anunciado una fecha específica para los pesos abiertos de Muse Spark 1.3.

Recent Posts

Claude Fable 5.1 y Mythos 5.1: Novedades Explicadas
SectorSep 3, 2026

Claude Fable 5.1 y Mythos 5.1: Novedades Explicadas

Claude Fable 5.1 y Mythos 5.1 explicados: el mismo modelo en dos niveles de salvaguarda, con nuevos benchmarks, un costo aproximadamente 25 a 45 por ciento menor y detalles de acceso.

EigentEigent
Gemini 3.8 Flash: Novedades en Programación e Inteligencia Artificial Agéntica
SectorSep 3, 2026

Gemini 3.8 Flash: Novedades en Programación e Inteligencia Artificial Agéntica

Gemini 3.8 Flash ofrece grandes mejoras en programación y razonamiento agéntico al mismo precio reducido, además de una nueva variante 3.8 Flash Cyber. Benchmarks, precios y cómo utilizarlo.

EigentEigent
GPT-6 Astra: Qué hace realmente el nuevo modelo de OpenAI
SectorSep 3, 2026

GPT-6 Astra: Qué hace realmente el nuevo modelo de OpenAI

GPT-6 Astra es el nuevo modelo insignia de OpenAI. Aquí encontrarás qué hace, cómo rinde en benchmarks, cuánto cuesta y las advertencias detrás de los titulares sobre AGI.

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

Prueba Eigent hoy

Descarga la aplicación de escritorio de código abierto y empieza a automatizar con una fuerza laboral de IA en tu equipo.

Descargar Eigent
Eigent

Recibe las últimas actualizaciones y tutoriales sobre automatización de la fuerza laboral con IA.

¡Gracias por suscribirte!

ProductoEigentEntornosPreciosEmpresarial
ExplorarSolucionesCasos de usoHabilidadesPluginsBlog
DesarrolladoresDocumentaciónGitHubCAMEL-AIFondo Open SourceSocio
DescargarPara código abierto
EmpresaSobre nosotrosMarcaEmpleosTérminos de usoPolítica de privacidadSeguridad y confianzaPolítica de cookiesPolítica de reembolso y prueba

Todos los derechos reservados © 2026 EIGENT UK LTD