Meta lanza Muse Glimmer, un modelo de IA de pesos abiertos que funciona localmente en laptops
Puntos clave
- •Muse Glimmer es el primer lanzamiento de pesos abiertos de Meta Superintelligence Labs, publicado bajo la licencia Apache 2.0 para permitir la descarga, modificación e implementación gratuita por parte de los desarrolladores.
- •El modelo de 30 mil millones de parámetros funciona en hardware de consumo con 24GB o 32GB de memoria, incluidas Mac con chips M4 o M5 y sistemas equipados con GPU NVIDIA RTX 5090 o AMD Radeon AI PRO.
- •Muse Glimmer está diseñado para aplicaciones de IA agéntica, permitiendo la ejecución autónoma de tareas de múltiples pasos, incluida la planificación de flujos de trabajo, la invocación de herramientas, la verificación de resultados y la recuperación de errores.
- •El sistema de decodificación especulativa DFlash de Meta aceleró la generación de texto del modelo hasta 3.1 veces en una NVIDIA RTX 5090 en comparación con el rendimiento de generación estándar.
- •El modelo está disponible en Hugging Face con soporte de integración para frameworks de código abierto como Ollama, LM Studio, llama.cpp y MLX, y Meta está colaborando con AMD, Arm, Dell, Intel y NVIDIA para la optimización de hardware.

Meta ha presentado Muse Glimmer, un modelo de inteligencia artificial de 30 mil millones de parámetros diseñado para funcionar localmente en computadoras de consumo. Los pesos del modelo se han publicado bajo la licencia Apache 2.0, lo que permite a los desarrolladores descargarlo, modificarlo e implementarlo libremente. Muse Glimmer marca el primer lanzamiento de Meta Superintelligence Labs en publicarse con pesos abiertos, continuando la estrategia de la compañía de lanzar sistemas de IA abiertos que siguió con su familia de modelos Llama. El enfoque de pesos abiertos contrasta con los modelos totalmente propietarios que ofrecen empresas como OpenAI y Google, ya que otorga a los desarrolladores visibilidad completa sobre el modelo y la capacidad de ajustarlo para casos de uso específicos sin depender de una API alojada en la nube.
Capacidades y arquitectura
Muse Glimmer está diseñado para agentes de IA capaces de ejecutar tareas de múltiples pasos sin supervisión continua del usuario. El modelo puede planificar flujos de trabajo, invocar herramientas externas, verificar resultados intermedios y recuperarse de pasos fallidos de forma autónoma. Esto sitúa a Glimmer dentro de un impulso creciente de la industria hacia la IA agéntica —modelos diseñados no solo para generar texto, sino para realizar acciones en nombre del usuario— donde empresas como Anthropic y Google también han estado invirtiendo fuertemente.
Según Meta, el modelo funciona en dispositivos equipados con 24GB o 32GB de memoria. El hardware compatible incluye Mac con chips M4 o M5, así como sistemas con una GPU de consumo única, como la NVIDIA RTX 5090 o la AMD Radeon AI PRO. No se requiere conexión a internet para la inferencia, lo que significa que los datos del usuario permanecen en el dispositivo durante el procesamiento —una consideración cada vez más importante a medida que las empresas y los reguladores examinan cómo fluye la información hacia los servicios de IA alojados en la nube.
El modelo admite tanto el procesamiento de texto como de imágenes y ha sido entrenado con conjuntos de datos que abarcan más de 100 idiomas.
Entrenamiento y optimización
Meta entrenó a Glimmer utilizando un proceso de destilación derivado de su modelo más grande, Muse Spark, complementado con entrenamiento enfocado en razonamiento, programación y tareas agénticas. La destilación —transferir capacidades de un modelo más grande a uno más pequeño y eficiente— se ha convertido en una técnica ampliamente utilizada para producir modelos que mantienen un rendimiento sólido y se ajustan a las limitaciones de memoria y capacidad de procesamiento del hardware de consumo. La empresa ha publicado versiones de precisión completa y de 4 bits del modelo, junto con código de inferencia y un sistema de decodificación especulativa DFlash diseñado para acelerar la generación de texto.
Meta informó que DFlash aumentó la velocidad de generación de Glimmer en 3.1 veces en una NVIDIA RTX 5090, en 1.8 veces en una M5 Max y en 1.5 veces en una M4 Max, en comparación con el rendimiento de generación estándar.
Disponibilidad y alianzas
Muse Glimmer está disponible a través de Hugging Face, y el soporte para herramientas como Ollama, LM Studio, llama.cpp y MLX se está implementando progresivamente. Estas se encuentran entre los frameworks de código abierto más utilizados para ejecutar modelos de lenguaje grandes localmente, y su integración significa que los desarrolladores pueden incorporar Glimmer en sus flujos de trabajo existentes sin necesidad de software propietario. Meta indicó que está colaborando con socios como AMD, Arm, Dell, Intel y NVIDIA para optimizar el rendimiento en diferentes plataformas de hardware.
La empresa señaló que los desarrolladores pueden aprovechar el modelo para programación local, invocación de herramientas, gestión de archivos y otras aplicaciones agénticas. También se espera que Meta publique los pesos de Muse Spark 1.2, uno de sus modelos fundacionales más importantes, en las próximas semanas, lo que daría a la comunidad de código abierto acceso a un modelo más grande y capaz para comparación y desarrollo adicional.
Fuente: TechNext24
Referencia principal: Meta Research – Presentación de Muse Glimmer