Meta brengt Muse Glimmer uit, een open-weight AI-model dat lokaal op laptops draait
Belangrijkste punten
- •Muse Glimmer is de eerste open-weight-release van Meta's Superintelligence Labs, gepubliceerd onder de Apache 2.0-licentie om ontwikkelaars vrij te laten downloaden, aanpassen en inzetten.
- •Het model van 30 miljard parameters draait op consumentenhardware met 24GB of 32GB geheugen, waaronder Macs met M4- of M5-chips en systemen met NVIDIA RTX 5090- of AMD Radeon AI PRO-GPU's.
- •Muse Glimmer is ontworpen voor agentic AI-toepassingen en maakt zelfstandige uitvoering van taken in meerdere stappen mogelijk, waaronder workflowplanning, tool-aanroepen, resultaatverificatie en foutafhandeling.
- •Het DFlash speculative decoding-systeem van Meta versnelde de tekstgeneratie van het model tot 3,1 keer op een NVIDIA RTX 5090 vergeleken met de standaard generatieprestaties.
- •Het model is beschikbaar op Hugging Face met integratieondersteuning voor open-source frameworks waaronder Ollama, LM Studio, llama.cpp en MLX, en Meta werkt samen met AMD, Arm, Dell, Intel en NVIDIA voor hardwareoptimalisatie.

Meta heeft Muse Glimmer geïntroduceerd, een kunstmatig-intelligentiemodel van 30 miljard parameters dat is gebouwd om lokaal op consumentencomputers te draaien. De weights van het model zijn gepubliceerd onder de Apache 2.0-licentie, waardoor ontwikkelaars het vrij kunnen downloaden, aanpassen en inzetten. Muse Glimmer is de eerste release van Meta Superintelligence Labs die met open weights wordt geleverd, waarmee het bedrijf zijn strategie voortzet van het uitbrengen van open AI-systemen die het eerder toepaste met zijn Llama-modelfamilie. De open-weight-benadering vormt een contrast met de volledig propriëtaire modellen die bedrijven zoals OpenAI en Google aanbieden, en geeft ontwikkelaars volledige inzage in het model en de mogelijkheid het te finetunen voor specifieke toepassingen zonder afhankelijk te zijn van een gehoste API.
Mogelijkheden en architectuur
Muse Glimmer is ontworpen voor AI-agents die taken in meerdere stappen kunnen uitvoeren zonder doorlopende begeleiding van de gebruiker. Het model kan workflows plannen, externe tools aanroepen, tussenresultaten verifiëren en zelfstandig herstellen van mislukte stappen. Daarmee positioneert Glimmer zich binnen een groeiende industriële beweging richting agentic AI—modellen die niet alleen tekst genereren maar ook acties namens de gebruiker ondernemen—waarin ook bedrijven als Anthropic en Google zwaar investeren.
Volgens Meta draait het model op apparaten die zijn uitgerust met 24GB of 32GB geheugen. Compatibele hardware omvat Macs met M4- of M5-chips, evenals systemen met een enkele consumenten-GPU zoals de NVIDIA RTX 5090 of AMD Radeon AI PRO. Voor het uitvoeren van inferentie is geen internetverbinding vereist, wat betekent dat gebruikersgegevens tijdens de verwerking op het apparaat blijven—aandachtspunt dat steeds belangrijker wordt nu bedrijven en toezichthouders grondiger onderzoeken hoe informatie naar clouddiensten voor AI stroomt.
Het model ondersteunt zowel tekst- als beeldverwerking en is getraind op datasets die meer dan 100 talen omvatten.
Training en optimalisatie
Meta trainde Glimmer met behulp van een distillatieproces dat is afgeleid van het grotere Muse Spark-model, aangevuld met gerichte training in redeneren, programmeren en agentic taken. Distillatie—het overdragen van capaciteiten van een groter model naar een kleiner, efficiënter model—is een veelgebruikte techniek geworden voor het produceren van modellen die sterke prestaties behouden en tegelijk binnen de geheugen- en rekenbeperkingen van consumentenhardware passen. Het bedrijf heeft zowel full-precision- als 4-bit-versies van het model uitgebracht, evenals inference code en een DFlash speculative decoding-systeem dat is gericht op het versnellen van tekstgeneratie.
Meta meldde dat DFlash de generatiesnelheid van Glimmer deed toenemen met een factor 3,1 op een NVIDIA RTX 5090, met een factor 1,8 op een M5 Max en met een factor 1,5 op een M4 Max, ten opzichte van de standaard generatieprestaties.
Beschikbaarheid en samenwerkingen
Muse Glimmer is toegankelijk via Hugging Face, en ondersteuning voor tools waaronder Ollama, LM Studio, llama.cpp en MLX wordt momenteel uitgerold. Dit behoren tot de meest gebruikte open-source frameworks voor het lokaal draaien van grote taalmodellen, en hun integratie betekent dat ontwikkelaars Glimmer kunnen inpassen in bestaande workflows zonder propriëtaire software. Meta zegt samen te werken met partners waaronder AMD, Arm, Dell, Intel en NVIDIA om de prestaties op verschillende hardwareplatformen te optimaliseren.
Het bedrijf merkte op dat ontwikkelaars het model kunnen inzetten voor lokale codeerwerkzaamheden, tool calling, bestandsbeheer en andere agentic toepassingen. Van Meta wordt ook verwacht dat het in de komende weken de weights van Muse Spark 1.2 vrijgeeft, een van zijn toonaangevende fundamentmodellen, wat de open-sourcegemeenschap toegang zou geven tot een groter, krachtiger model voor vergelijking en verdere ontwikkeling.
Bron: TechNext24
Primaire referentie: Meta Research – Introductie van Muse Glimmer