Binnenkant van een computerkast met een videokaart en ventilatoren
Nieuws10 augustus · 14:096 min leestijd

Meta geeft agentmodel Muse Glimmer vrij onder Apache 2.0

Meta zet de gewichten van agentmodel Muse Glimmer onder Apache 2.0 op Hugging Face. Het model van 30 miljard parameters draait op één consumenten-GPU en keert de gesloten koers van juni om.

Update · 10 augustus · 18:29

Meta belooft ook open gewichten van Muse Spark 1.2 en een veiling voor rekenkracht

Meta geeft ook van zijn sterkste model de gewichten vrij: een open-weight versie van Muse Spark 1.2 volgt binnen enkele weken, zei Zuckerberg tegen Axios voorafgaand aan zijn essay, en de Wall Street Journal en Quartz melden hetzelfde. Dat corrigeert wat hierboven staat over Muse Spark, al ontbreken een datum en de licentietekst nog, en juist die tekst maakte Muse Glimmer bruikbaar voor een Nederlands bedrijf: onveranderde Apache 2.0, zonder EU-uitsluiting en zonder omzetgrens. Het essay bevat een tweede nieuw feit, want wie meer rekenkracht wil dan de gratis versies betaalt straks via een dynamisch veilingmechanisme dat volgens Meta iedereen de laagst mogelijke prijs garandeert en schaarse capaciteit toewijst aan wat gebruikers samen het meest waardevol vinden; Meta's onafhankelijke board keurt voortaan ook de veiligheidscriteria voor modelreleases goed. The Decoder wijst erop dat er nog geen product, geen tijdlijn en geen uitsluitsel over wie eronder valt is, en het plan staat haaks op de analistencall van 30 juli waarin Zuckerberg rekenkracht verkopen voor snelle winst dwaas noemde. Voor wie AI-kosten begroot verandert dat het karakter van de rekening: bij een veiling is de prijs per token geen tarief meer maar een uitkomst van vraag, wat een vaste prijslijst zoals de huidige 1,25 dollar per miljoen invoertokens minder vanzelfsprekend maakt.

Meta brengt Muse Glimmer uit, een agentmodel van 30 miljard parameters, en zet de gewichten onder Apache 2.0 op Hugging Face waar iedereen ze zonder aanvraag of goedkeuring kan downloaden. Het onderzoekslab van Meta schrijft dat het model op één consumenten-GPU of een Mac draait en gebouwd is voor lokale agents die zelf gereedschap aanroepen.

Voor een Nederlands bedrijf dat vandaag per token afrekent bij een API verschuift daarmee de rekensom. Meta vraagt op zijn eigen platform 1,25 dollar per miljoen invoertokens en 4,25 dollar per miljoen uitvoertokens voor het gesloten Muse Spark 1.2. Muse Glimmer haalt op een RTX 5090 gemiddeld 233,4 tokens per seconde, ruim 840.000 per uur, en die hoeveelheid uitvoer zou via die API zo'n 3,50 dollar per uur kosten. Glimmer is niet hetzelfde model als Spark maar een kleinere, gedestilleerde versie ervan. Voor het routinewerk binnen een agent verandert de vraag daarmee van "wat kost een token" in "staat er een kaart met 24 GB geheugen in huis".

In diezelfde prijstabel staat nog een tweede afweging. Wie de contributor-variant van Muse Spark 1.2 gebruikt betaalt 0,10 dollar per miljoen invoertokens in plaats van 1,25, en Meta noteert erbij dat die invoer wordt gebruikt om zijn producten te verbeteren. Een model dat op je eigen machine draait kent die ruil niet: de prompt, het klantdossier en de screenshot blijven binnen je eigen netwerk.

De licentie is echt Apache 2.0

Het LICENSE-bestand in de repository is de onveranderde Apache 2.0-tekst, zonder regionale uitsluiting en zonder omzetgrens. De download staat bovendien niet achter een formulier: de bestanden zijn direct op te halen, ook de GGUF-varianten en een ExecuTorch-versie voor Apple-silicium.

Dat is minder vanzelfsprekend dan het klinkt. Bij open gewichten zit het addertje vaak in de licentie en niet in de modelkaart, zoals bij MiniMax, dat vorige week de gewichten van videomodel H3 publiceerde maar de EU, het VK, Zuid-Korea en de VS als "Excluded Territories" uitsloot. Bij Muse Glimmer staat er wel een apart document naast het licentiebestand, een usage policy die onder meer militaire toepassingen, wapenontwikkeling en het bedienen van kritieke infrastructuur verbiedt. Die tekst staat naast de licentie, niet erin.

Sterk in agentwerk, niet overal de beste

Meta zet Muse Glimmer af tegen Gemma4-31B en Qwen3.6-27B, twee open modellen in dezelfde gewichtsklasse. Op agentische taken wint het duidelijk: op MCP Atlas scoort het 75,5 tegen 54,2 en 62,5, op DeepSearch QA 74,6 tegen 61,7 en 71,1, en op SWE-Bench Pro 51,2 tegen 36,9 en 50,2. Op ander werk verliest het net zo duidelijk. Qwen3.6-27B haalt op OSWorld-Verified 75,6 tegen 65,9 voor Glimmer, en op TerminalBench 2.1 60,7 tegen 51,7.

Benchmarkscores van Muse Glimmer-30B tegenover twee open modellen in dezelfde klasse (bron: modelkaart Meta)

De hardware-eisen zijn concreter dan bij de meeste modelreleases. In volle precisie vraagt Muse Glimmer ruim 55 GB geheugen. Meta comprimeert de gewichten naar ongeveer 4 bit, waarmee het taalmodel onder de 20 GB zakt en het geheel met cache en beeldencoder binnen 24 tot 32 GB past. Het kwaliteitsverlies daarvan meet Meta op 1,0 procent bij de 24 GB-variant en 0,2 procent bij de 32 GB-variant, gemiddeld over vijftien benchmarks. Een meegeleverd hulpmodel voorspelt blokken van zestien tokens tegelijk, wat de snelheid op een RTX 5090 van 74,9 naar 233,4 tokens per seconde tilt en op een MacBook M5 Max van 26,6 naar 50,2.

Compacte desktop-pc met een GeForce RTX 5070-videokaart, naast een Nvidia DGX Spark. Bron: Daniel Lu (User:dllu) / Wikimedia Commons (CC BY-SA 4.0)
Compacte desktop-pc met een GeForce RTX 5070-videokaart, naast een Nvidia DGX Spark. Bron: Daniel Lu (User:dllu) / Wikimedia Commons (CC BY-SA 4.0)

Verder telt het model een contextvenster van 131.072 tokens, verwerkt het tekst en beeld maar geen audio, en loopt de kennis tot 4 januari 2026. Draaien kan via Ollama, LM Studio, vLLM en SGLang, en Meta werkt samen met AMD, Arm, Dell, Intel en Nvidia aan optimalisaties per apparaat.

Meta draait terug wat het in juni losliet

Deze release keert precies om wat het bedrijf twee maanden geleden aankondigde. In juni bleek Meta zijn open Llama-lijn te hebben losgelaten en het nieuwe topmodel Muse Spark gesloten en betaald te houden, een omslag die AI-chef Alexandr Wang toen verdedigde met het argument dat de oude aanpak niet meer werkte. Eind juli volgde de retorische draai, toen Zuckerberg de gesloten koers van OpenAI en Anthropic gevaarlijker noemde dan open ontwikkeling terwijl Muse Spark 1.1 sinds 9 juli alleen achter een betaalde API zat. Vandaag staat er voor het eerst weer een daad tegenover de woorden.

Die woorden kwamen er trouwens opnieuw bij. Naast het model publiceerde Zuckerberg een essay van veertien pagina's, "The Future is for Everyone", waarin hij schrijft dat Meta open source blijft steunen en binnenkort weer open modellen gaat uitbrengen. Hij noemt het beperken van buitenlandse open modellen geen effectieve oplossing en stelt dat Amerikaanse open modellen simpelweg de beste ter wereld zouden moeten zijn. Tegen Reuters zei hij dat er nog grotere modellen aankomen, zonder erbij te zeggen welke daarvan open gewichten krijgen.

De grens blijft niettemin waar hij lag. Muse Spark, het sterkste model van het huis, blijft gesloten en betaald; wat vrijkomt is de gedestilleerde kleine broer. Dat is het patroon dat zich in de hele sector aftekent: open aan de onderkant, dicht aan de top.

Toch verandert er iets voor wie hier bouwt. De sterkste zelf te draaien modellen kwamen de afgelopen maanden vooral uit China, waarmee open gewichten weliswaar de Amerikaanse leveranciersgreep ontwijken maar een Chinese jurisdictie meebrengen. Daar staat nu een westers model naast dat je zonder licentiebeperking op een kaart onder je bureau zet. Het is niet het beste model in de markt, en dat hoeft het ook niet te zijn: voor het gestage agentwerk waarin tokens zich opstapelen, telt vooral wat het per uur kost en waar de data blijft.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Een model op je eigen hardware

Een lokaal draaiend model is pas nuttig als het in je processen hangt, met de juiste koppelingen en bewaking eromheen. Ik denk mee over die keuze, ontwerp de opzet en bouw hem af, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Nvidia geeft agentmodel Nemotron 3.5 Lightning vrij met een modelrouter erbij
Nieuws
5 min

11 aug 16:10

Nvidia geeft agentmodel Nemotron 3.5 Lightning vrij met een modelrouter erbij

Nvidia publiceert de gewichten van agentmodel Nemotron 3.5 Lightning onder OpenMDW-1.1, een licentie zonder gebruiksbeperkingen, en levert er een routeerlaag bij die in LangChains test 74 procent van de kosten wegneemt.

Alibaba wil omzetdeling vragen voor de volgende open-source Qwen
Nieuws
4 min

7 aug 04:10

Alibaba wil omzetdeling vragen voor de volgende open-source Qwen

Alibaba wil grote gebruikers van de volgende open-source Qwen een deel van hun omzet laten afdragen, meldt Reuters. Het sjabloon staat al in de licentie van Kimi K3: boven 20 miljoen dollar omzet volgt een aparte overeenkomst.

Zuckerberg bekritiseert gesloten AI-koers van OpenAI en Anthropic
Nieuws
5 min

29 jul 06:12

Zuckerberg bekritiseert gesloten AI-koers van OpenAI en Anthropic

Zuckerberg noemt de gesloten aanpak van OpenAI en Anthropic gevaarlijker dan open ontwikkeling, in een WSJ-opiniestuk en een NYT-interview. Meta's eigen beste model zit sinds 9 juli achter een betaalde API.

Tencent stelt Hy3 wereldwijd beschikbaar via WorkBuddy en Tencent Cloud
Nieuws
5 min

5 aug 10:37

Tencent stelt Hy3 wereldwijd beschikbaar via WorkBuddy en Tencent Cloud

Tencent maakt Hy3 wereldwijd afneembaar via WorkBuddy, Miora en TokenHub. De licentie sluit geen enkel gebied uit, maar het privacybeleid van WorkBuddy zet je gegevens op servers in Singapore, met toegang vanuit China.

MiniMax zet gewichten van videomodel H3 online en sluit de EU uit
Nieuws
4 min

3 aug 18:12

MiniMax zet gewichten van videomodel H3 online en sluit de EU uit

MiniMax publiceerde de gewichten van videomodel H3 op Hugging Face, maar de licentie sluit de EU, het VK, Zuid-Korea en de VS uit. Alleen de 768p-basis is open, de 2K-module blijft dicht.

Alibaba zet de gewichten van Qwen3.8-Max volgende week open
Nieuws
5 min

3 aug 06:12

Alibaba zet de gewichten van Qwen3.8-Max volgende week open

Alibaba maakt Qwen3.8-Max wereldwijd beschikbaar en zet de gewichten volgende week open, samen met een kleinere 27B-versie. Het gehoste model kost 2 dollar per miljoen invoertokens, ruim onder Claude Opus 5.