Meta vient de lâcher Muse Glimmer, un modèle d’IA open source de 30 milliards de paramètres conçu pour une seule chose : faire tourner un agent IA directement sur ta machine, sans cloud, sans abonnement, même sans connexion. Les poids sont téléchargés gratuitement sur Hugging Face, sous licence Apache 2.0, et la promesse est claire : tu récupères la main sur ton assistant. Voilà ce que ça change concrètement pour toi.
Un agent complet qui tient dans ta machine
Muse Glimmer n’est pas un énième chatbot. C’est un modèle « agentique » : il est entraîné pour enchaîner les actions, appeler des outils, corriger ses erreurs et mener des tâches longues sans tout casser au premier obstacle. Il comprend aussi les images, ce qui lui permet de lire une capture d’écran, un graphique ou un document. Meta le compare aux modèles de sa catégorie, comme Gemma4 de Google ou Qwen3.6 d’Alibaba, et il s’en sort très bien sur les tests d’agents : planification, écriture et correction de code, résolution de demandes en plusieurs étapes.
Concrètement, tu peux lui confier des boulots du quotidien : gérer ton agenda, trier des fichiers, préparer une réponse, ou l’utiliser comme assistant de code sur ta machine. Il fonctionne avec les outils d’orchestration d’agents déjà connus comme OpenClaw, et parle plus de cent langues. Bref, c’est un assistant de travail, pas un gadget de démo.

Source : Meta AI Research, blog officiel — https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
Rapide en local, et sans abonnement
Le vrai tour de force, c’est la taille. Un modèle de 30 milliards de paramètres en pleine précision demanderait plus de 55 Go de mémoire, ce qui dépasse n’importe quelle carte grand public. Meta a compressé les poids en 4 bits : le modèle passe sous les 20 Go, ce qui laisse de la place pour la mémoire de travail et le module de vision. Résultat, il tourne dans une machine avec 24 à 32 Go de VRAM, comme une RTX 5090, ou sur un MacBook M4 ou M5 Max.
Pour que ce soit utilisable au quotidien, Meta ajoute une astuce de vitesse : un « draft » propose des blocs de texte entiers, validés en parallèle par le modèle principal. Sur une RTX 5090, la génération passe d’environ 75 à plus de 230 caractères par seconde, soit trois fois plus vite. Les intégrations avec Ollama, LM Studio et llama.cpp arrivent dans les jours qui viennent, donc tu n’auras pas besoin d’être développeur pour l’essayer.

Source : Meta AI Research, blog officiel — https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
Les limites à connaître avant de foncer
Restons lucides. Muse Glimmer reste un modèle de 30 milliards de paramètres : il est moins puissant que les gros modèles cloud comme Muse Spark, et sur certains tests, Google et Alibaba font jeu égal, voire mieux. Il faut aussi une machine costaud : 24 Go de VRAM minimum pour la version la plus légère, ce qui n’est pas donné à tout le monde. Les versions compressées perdent un peu de précision sur les cas limites, et Meta le déconseille aux moins de 18 ans.
Enfin, la licence est permissive, mais ce n’est pas une garantie magique : un agent capable d’appeler des outils peut faire des bêtises s’il est mal configuré. Meta recommande de garder un humain dans la boucle pour les actions irréversibles. Prudence, donc, mais l’idée de fond est là : l’IA locale devient un choix crédible, même pour un usage personnel.
Ton PC redevient le héros
Ce qui compte dans cette annonce, ce n’est pas un énième record de benchmark. C’est que Meta pousse un modèle open source capable de faire tourner un agent entier sur une machine personnelle, gratuitement et hors ligne. Si tu as une carte graphique récente, tu n’as plus besoin d’un abonnement au cloud pour avoir un assistant qui travaille avec toi. L’IA de poche, c’est maintenant — et elle parle français.
Sources
Meta AI Research, annonce officielle de Muse Glimmer : https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
Hugging Face, carte du modèle Muse Glimmer 30B : https://huggingface.co/meta-models/Muse-Glimmer-30B
Engadget, « Meta’s 'open source' Muse Glimmer model can run on a single computer » : https://www.engadget.com/2233312/metas-open-source-muse-glimmer-model-can-run-on-a-single-computer/
AMD, optimisation de Muse Glimmer sur Ryzen AI Max et Radeon : https://www.amd.com/en/blogs/2026/run-meta-muse-glimmer-30b-on-amd-ryzen-ai-max-and-radeon-gpus.html
—
Recherche, relecture et illustration assistées par IA. Le contenu reflète le travail éditorial de la rédaction.




No comments yet