ActualitésActionsMeta publie Muse Glimmer, un modèle d'IA à poids ouverts fonctionnant localement sur ordinateurs portables

Meta publie Muse Glimmer, un modèle d'IA à poids ouverts fonctionnant localement sur ordinateurs portables

Auteur: TechNext24·

Points clés

  • Muse Glimmer est la première publication à poids ouverts des Superintelligence Labs de Meta, publiée sous licence Apache 2.0 pour permettre le téléchargement, la modification et le déploiement libres par les développeurs.
  • Le modèle de 30 milliards de paramètres fonctionne sur du matériel grand public avec 24 Go ou 32 Go de mémoire, notamment des Mac dotés de puces M4 ou M5 et des systèmes équipés de GPU NVIDIA RTX 5090 ou AMD Radeon AI PRO.
  • Muse Glimmer est conçu pour des applications d'IA agentique, permettant l'exécution autonome de tâches multi-étapes, notamment la planification de flux de travail, l'invocation d'outils, la vérification des résultats et la récupération après erreur.
  • Le système de décodage spéculatif DFlash de Meta a accéléré la génération de texte du modèle jusqu'à 3,1 fois sur une NVIDIA RTX 5090 par rapport aux performances de génération standards.
  • Le modèle est disponible sur Hugging Face avec une prise en charge d'intégration pour les frameworks open source dont Ollama, LM Studio, llama.cpp et MLX, et Meta collabore avec AMD, Arm, Dell, Intel et NVIDIA pour l'optimisation matérielle.
Meta publie Muse Glimmer, un modèle d'IA à poids ouverts fonctionnant localement sur ordinateurs portables

Meta a présenté Muse Glimmer, un modèle d'intelligence artificielle de 30 milliards de paramètres conçu pour fonctionner localement sur des ordinateurs grand public. Les poids du modèle ont été publiés sous licence Apache 2.0, permettant aux développeurs de le télécharger, modifier et déployer librement. Muse Glimmer marque la première publication de Meta Superintelligence Labs distribuée avec des poids ouverts, prolongeant la stratégie de l'entreprise de publication de systèmes d'IA ouverts qu'elle a suivie avec sa famille de modèles Llama. L'approche à poids ouverts contraste avec les modèles entièrement propriétaires proposés par des entreprises telles qu'OpenAI et Google, offrant aux développeurs une visibilité complète sur le modèle et la capacité de l'affiner pour des cas d'usage spécifiques sans dépendre d'une API hébergée.

Capacités et Architecture

Muse Glimmer est conçu pour des agents d'IA capables d'exécuter des tâches multi-étapes sans surveillance continue de l'utilisateur. Le modèle peut planifier des flux de travail, invoquer des outils externes, vérifier les résultats intermédiaires et se rétablir après des étapes échouées de manière autonome. Cela positionne Glimmer dans une dynamique industrielle croissante vers l'IA agentique — des modèles conçus non seulement pour générer du texte mais aussi pour agir au nom de l'utilisateur — où des entreprises telles qu'Anthropic et Google investissent également massivement.

Selon Meta, le modèle fonctionne sur des appareils équipés de 24 Go ou 32 Go de mémoire. Le matériel compatible comprend les Mac dotés de puces M4 ou M5, ainsi que des systèmes équipés d'un GPU grand public unique tel que la NVIDIA RTX 5090 ou l'AMD Radeon AI PRO. Aucune connexion Internet n'est requise pour l'inférence, ce qui signifie que les données de l'utilisateur restent sur l'appareil pendant le traitement — une considération de plus en plus importante à mesure que les entreprises et les régulateurs examinent la manière dont les informations sont transmises aux services d'IA hébergés dans le cloud.

Le modèle prend en charge le traitement du texte et des images et a été entraîné sur des jeux de données couvrant plus de 100 langues.

Entraînement et Optimisation

Meta a entraîné Glimmer à l'aide d'un processus de distillation dérivé de son modèle Muse Spark plus volumineux, complété par un entraînement ciblé en raisonnement, codage et tâches agentiques. La distillation — qui consiste à transférer les capacités d'un modèle plus grand vers un modèle plus petit et plus efficace — est devenue une technique largement utilisée pour produire des modèles qui conservent de bonnes performances tout en s'inscrivant dans les contraintes de mémoire et de calcul du matériel grand public. L'entreprise a publié des versions en pleine précision et en 4 bits du modèle, ainsi que du code d'inférence et un système de décodage spéculatif DFlash conçu pour accélérer la génération de texte.

Meta a indiqué que DFlash a augmenté la vitesse de génération de Glimmer de 3,1 fois sur une NVIDIA RTX 5090, de 1,8 fois sur un M5 Max et de 1,5 fois sur un M4 Max, par rapport aux performances de génération standards.

Disponibilité et Partenariats

Muse Glimmer est accessible via Hugging Face, avec une prise en charge d'outils tels qu'Ollama, LM Studio, llama.cpp et MLX en cours de déploiement. Ces outils figurent parmi les frameworks open source les plus largement utilisés pour exécuter localement des modèles de langage de grande taille, et leur intégration signifie que les développeurs peuvent incorporer Glimmer dans leurs flux de travail existants sans logiciel propriétaire. Meta a déclaré collaborer avec des partenaires dont AMD, Arm, Dell, Intel et NVIDIA pour optimiser les performances sur les différentes plateformes matérielles.

L'entreprise a indiqué que les développeurs peuvent exploiter le modèle pour le codage local, l'appel d'outils, la gestion de fichiers et d'autres applications agentiques. Meta devrait également publier les poids de Muse Spark 1.2, l'un de ses principaux modèles fondamentaux, dans les prochaines semaines, ce qui donnerait à la communauté open source l'accès à un modèle plus volumineux et plus performant pour la comparaison et le développement ultérieur.

Source : TechNext24

Référence principale : Meta Research – Présentation de Muse Glimmer