Wanneer een krachtig AI-model niets per aanvraag kost
Meta heeft een krachtig AI-model uitgebracht dat iedereen gratis op eigen hardware kan draaien — dat verandert hoeveel het kost om AI-producten te bouwen.
- 30B
- parameters, samengeperst voor één GPU
- Apache 2.0
- licentie — vrij voor commercieel gebruik
- 24 GB
- GPU-geheugen om lokaal te draaien
- 51.2
- codering-benchmarkscore (SWE-Bench Pro)
Een krachtige AI inzetten betekende altijd een API-rekening betalen — kleine fracties per tekstfragment, maar die lopen snel op bij grote volumes. Meta bracht Muse Glimmer uit op 10 augustus onder een Apache 2.0-licentie: een model van 30 miljard parameters, gebouwd voor echte agentische taken, gratis voor commercieel gebruik en ontworpen om op één consumentengrafische kaart te draaien.
Muse Glimmer is gebouwd voor werk waarbij een AI een doel oppakt, het opsplitst in stappen, tools aanroept en doorgaat totdat het klaar is. Het verwerkt tekst en afbeeldingen, ondersteunt codering, documentanalyse en functieaanroepen en past na compressie op een 24 GB grafische kaart. Meta rapporteert een SWE-Bench Pro-score van 51,2 — een benchmark die meet hoe goed het model echte softwarefouten oplost — wat het in de buurt brengt van betaalde frontiermodellen.
Apache 2.0 is het cruciale punt. Veel 'open' AI-modellen beperken commercieel gebruik boven een bepaalde schaal of staan geen aanpassingen toe. Dit model niet. Voor teams waarbij data op eigen servers moet blijven — in fintech, juridische diensten of zorg — is dit de eerste keer dat een model van dit niveau zonder beperkingen beschikbaar is.
De praktische stap is een kostenvergelijking maken. Muse Glimmer verslaat de grootste betaalde modellen niet bij elke taak, maar voor interne tools, codeerassistenten of workflows die honderden keren per dag worden uitgevoerd, kan een eigen model nu goedkoper zijn dan betalen per token. Het staat nu op Hugging Face en werkt met ollama 0.32.7 en later.