L'IA qui tourne sur votre propre machine est désormais assez bonne pour compter
Le nouveau modèle ouvert de Meta fonctionne sur un seul GPU grand public, gère des tâches complexes d'agents et ne coûte rien par requête — un vrai changement pour toute entreprise soucieuse de confidentialité ou de factures API.
- 30B
- paramètres du modèle
- 24 GB
- mémoire GPU nécessaire
- 75.5
- score benchmark agents (MCP Atlas)
- Apache 2.0
- licence — gratuite pour usage commercial
Jusqu'à la semaine dernière, faire tourner un agent IA vraiment capable signifiait une chose : envoyer vos données sur le serveur d'une autre entreprise et payer pour chaque requête. Meta a changé cela le 10 août avec la sortie de Muse Glimmer — une IA capable qui fonctionne entièrement sur votre propre matériel. Elle est libre d'utilisation commerciale sous licence Apache 2.0. Pas d'abonnement mensuel, pas de frais par token, pas de limites d'usage.
Muse Glimmer compte 30 milliards de paramètres — une mesure de ce qu'il a appris. C'est suffisamment grand pour du vrai travail : appeler des outils, lire de longs documents, écrire et exécuter du code, et évaluer ses propres résultats. Sur le principal benchmark d'agents (MCP Atlas), il obtient 75.5, contre 54.2 pour Gemma4-31B de Google et 62.5 pour Qwen3.6-27B. Il surpasse les modèles de taille similaire sur les tâches que les agents font vraiment. Il tient sur une carte graphique de 24 Go — comme on en trouve dans un PC de jeu milieu de gamme ou un MacBook Pro récent.
Pour les entreprises du droit, de la finance ou de la santé, l'argument de confidentialité est le plus important. Chaque document que vous envoyez à une IA cloud est une donnée que vous confiez au serveur d'une autre société. Avec Muse Glimmer, vos données n'ont jamais à quitter vos locaux. Un cabinet d'avocats peut faire tourner des agents d'analyse de contrats, une équipe fintech peut vérifier la logique de conformité, une clinique peut analyser des notes de patients — tout cela sur une machine qu'elle possède et contrôle.
Le modèle économique change aussi. Les API cloud facturent au token — les petits morceaux de texte que le modèle lit et écrit. Un agent qui réessaie, tourne en boucle ou effectue des centaines de vérifications par jour peut générer une facture étonnamment élevée. Avec un modèle local, le coût devient fixe : achetez le matériel une fois, utilisez-le autant que nécessaire. Si votre volume d'agents augmente ou si vos données sont sensibles, Muse Glimmer mérite un test cette semaine — les poids sont gratuits à télécharger sur Hugging Face.