NoticiasAccionesMeta lanza Muse Code en beta mientras Claude Opus 5 lidera los benchmarks

Meta lanza Muse Code en beta mientras Claude Opus 5 lidera los benchmarks

Autor: Cryptopolitan·

Puntos clave

  • Meta lanzó Muse Code en versión beta, un agente de codificación basado en terminal impulsado por el modelo Muse Spark 1.2, que supera a Codex de OpenAI y a Antigravity de Google en la mayoría de los benchmarks de codificación, pero se queda por detrás de Claude Opus 5 de Anthropic en todos los benchmarks publicados.
  • Muse Code mantiene un registro de eventos local que registra todas las llamadas al modelo, ejecuciones de herramientas, aprobaciones y ediciones, lo que permite al agente reanudar su trabajo sin interrupciones tras fallos durante tareas de larga duración.
  • El agente puede distribuir subagentes paralelos en worktrees aislados de modo que la copia de trabajo del desarrollador nunca se modifica, como se demostró cuando creó seis funciones de un juego simultáneamente sin colisiones.
  • Meta está compitiendo por precio en lugar de por el mejor rendimiento en benchmarks, reflejando un patrón más amplio del mercado donde los proveedores se diferencian por costo, apertura o integración cuando no pueden reclamar el liderazgo en benchmarks.
  • Un modelo de IA más grande de Meta con nombre en clave Watermelon aún se encuentra en fase de entrenamiento, y la empresa ha informado a los inversores que prevé gastar entre 125.000 millones y 145.000 millones de dólares este año en chips, centros de datos e infraestructura relacionada.
Meta lanza Muse Code en beta mientras Claude Opus 5 lidera los benchmarks

Meta lanzó Muse Code (beta), un agente de codificación basado en terminal, el miércoles. El lanzamiento sitúa a Meta en competencia directa con un campo de herramientas de codificación con IA en rápido crecimiento —que incluye Codex de OpenAI, Antigravity de Google, Claude de Anthropic y agentes independientes como Cursor y Devin—, a medida que los desarrolladores delegan cada vez más tareas de ingeniería multiarchivo a modelos autónomos. Los propios gráficos de Meta muestran que el modelo supera a Codex de OpenAI y a Antigravity de Google en la mayoría de las pruebas de codificación, mientras que se queda por detrás de Claude Opus 5 de Anthropic en todos los benchmarks que Meta publicó.

Muse Code sigue por detrás de Opus 5 pero añade un registro a prueba de fallos

Muse Code está impulsado por Muse Spark 1.2, una actualización del modelo de codificación que Meta abrió a los desarrolladores de EE. UU. en julio.

En los benchmarks que Meta presentó, Muse Spark 1.2 va por detrás de Opus 5 pero supera a Codex y Antigravity en la mayoría de las pruebas. Meta describió el modelo como su "siguiente paso hacia la frontera, con modelos más grandes y mucho más capaces en camino".

La empresa indicó que la versión 1.2 es mejor en generación de código, depuración y comprensión de bases de código grandes, después de que aumentara la capacidad computacional destinada a tareas de codificación durante el entrenamiento.

En un caso de estudio, el modelo reescribió kernels de GPU para chips NVIDIA Hopper mediante más de 1.000 llamadas a herramientas durante un máximo de 24 horas, trabajando a partir de una línea base con la instrucción de no copiar de bibliotecas existentes.

Muse Code mantiene un registro de eventos local que registra todas las llamadas al modelo, ejecuciones de herramientas, aprobaciones y ediciones. "Esta fuente única de verdad hace que el tiempo de ejecución sea de reproducción exacta y seguro ante reinicios", escribió Meta en su publicación de blog sobre el registro.

Si ocurre un fallo, el agente puede retomar el trabajo desde donde se detuvo. El agente también mantiene subagentes en segundo plano funcionando durante toda la sesión. Esa resiliencia es importante para tareas de larga duración, donde un solo fallo puede costar horas de cómputo.

Mark Zuckerberg, CEO de Meta, escribió en una publicación: "Cuando un trabajo es lo suficientemente grande, se divide en subagentes separados que trabajan en paralelo en worktrees aislados". Añadió: "Tu copia de trabajo nunca se toca. En las pruebas le pedimos que creara seis funciones para un juego simultáneamente sin colisiones".

Releasing Muse Code in beta today. It's a terminal coding agent that takes on complete software engineering tasks across large repos: planning changes, writing code, validating the results. Powered by Muse Spark 1.2, a coding-focused model update. pic.twitter.com/xqavk41w6v — Mark Zuckerberg (@finkd) August 5, 2026

/plan, /grill y la apuesta de Meta por el costo

Muse Code incluye varios comandos integrados. /plan convierte una solicitud en un plan con aprobación obligatoria, /grill somete a prueba de estrés ese plan hasta que se sostiene, y /goal impulsa la finalización del objetivo establecido.

Los desarrolladores pueden instalar el agente en macOS o Linux con un solo comando curl. Muse Spark 1.2 también está disponible a través de la API de Meta Model.

El modelo y el agente están diseñados para trabajar juntos, con el conjunto de herramientas de Muse Code manteniéndolos compatibles.

Parte de los datos de entrenamiento provino del anterior Muse Spark 1.1, que generaba problemas de codificación difíciles y calificaba las respuestas de los candidatos. Meta indicó que este ciclo ayudó al nuevo modelo a seguir las instrucciones con mayor precisión.

Meta está comunicando a sus inversores que prevé gastar entre 125.000 millones y 145.000 millones de dólares este año en chips, centros de datos y otra infraestructura.

Con Opus 5 fuera de alcance en los benchmarks, la empresa está compitiendo por precio en su lugar. Ese enfoque refleja un patrón más amplio en el mercado de modelos de IA, donde los proveedores que no pueden reclamar el primer puesto en benchmarks se diferencian por costo, apertura o profundidad de integración. Un modelo de IA más grande de Meta, con nombre en clave Watermelon, aún se encuentra en fase de entrenamiento.

Si estás leyendo esto, ya vas por delante. Mantente ahí con nuestro newsletter.