Quand un modèle d'IA puissant ne coûte rien par requête
Meta a publié un modèle d'IA puissant que n'importe qui peut faire tourner gratuitement sur ses propres machines, ce qui change combien coûte la création de produits IA.
- 30B
- paramètres, compressé pour un seul GPU
- Apache 2.0
- licence — libre pour usage commercial
- 24 GB
- mémoire GPU pour le faire tourner localement
- 51.2
- score sur le benchmark de code (SWE-Bench Pro)
Utiliser une IA capable voulait dire payer une facture d'API à chaque exécution — des fractions de centime par fragment de texte qui s'accumulent vite à grande échelle. Meta a publié Muse Glimmer le 10 août sous licence Apache 2.0 : un modèle de 30 milliards de paramètres pensé pour des tâches agentiques réelles, libre pour un usage commercial et conçu pour tourner sur une seule carte graphique grand public.
Muse Glimmer est construit pour les tâches où une IA doit prendre un objectif, le décomposer en étapes, appeler des outils et continuer jusqu'à la fin. Il traite texte et images, gère le code, l'analyse de documents et les appels de fonctions, et tient sur une carte graphique de 24 Go après compression. Meta annonce un score de 51,2 sur SWE-Bench Pro — un benchmark qui mesure la capacité du modèle à corriger de vrais bugs logiciels — ce qui le place dans la même gamme que des modèles payants avancés.
La licence Apache 2.0 est l'essentiel. Beaucoup de modèles d'IA dits 'ouverts' restreignent l'usage commercial au-delà d'une certaine taille ou interdisent les modifications. Celui-ci n'a pas ces limites. Pour les équipes où les données ne peuvent pas quitter vos propres serveurs — en fintech, droit ou santé — c'est la première fois qu'un modèle aussi performant est disponible sans conditions.
La démarche pratique est de comparer les coûts. Muse Glimmer ne bat pas les grands modèles payants sur toutes les tâches, mais pour des outils internes, des assistants de code ou des workflows qui tournent des centaines de fois par jour, utiliser son propre modèle peut revenir moins cher que payer au token. Il est disponible sur Hugging Face et fonctionne avec ollama 0.32.7 et versions ultérieures.