Ollama a publié la version 0.32.7 le 10 août 2026, et pour une fois la nouveauté principale est un modèle, pas une fonctionnalité. Muse Glimmer, le nouveau modèle ouvert de Meta et le premier publié par Meta Superintelligence Labs, est désormais disponible via Ollama.
Lisez la réserve avant de libérer de l’espace disque, parce qu’elle compte plus que l’annonce elle-même pour la plupart d’entre nous. Le support dans la 0.32.7 est initial, et il ne fonctionne que sur le moteur MLX d’Ollama, sur Apple Silicon. Si votre machine d’inférence est un PC x86 avec une carte NVIDIA, ce qui décrit la majorité des homelabs, cette version ne vous donne rien à faire tourner pour l’instant.
Ce qu’est Muse Glimmer
Muse Glimmer est un modèle multimodal de 30 milliards de paramètres que Meta a conçu spécifiquement pour les charges de travail d’agents tournant en local. C’est ce dernier point qui le rend intéressant en auto-hébergement. Beaucoup de modèles ouverts sont bons en conversation et deviennent médiocres dès qu’on leur demande d’appeler des outils en boucle. Un modèle pensé autour du travail d’agent local, c’est une proposition différente, au moins sur le papier.
Multimodal signifie ici entrée image, que le moteur MLX d’Ollama prend en charge à partir de la 0.32.7. Le moteur gère aussi DFlash pour ce modèle.
La limitation Apple Silicon, dite clairement
Les notes de version d’Ollama qualifient elles-mêmes le support actuel d’initial. Le support et les optimisations supplémentaires pour Apple Silicon, NVIDIA, AMD et les autres plateformes sont annoncés comme arrivant « dans les jours à venir ». Aucune date ferme, aucun numéro de build.
La situation pratique au 14 août est donc simple. Un Mac équipé d’une puce M avec assez de mémoire unifiée peut faire tourner Muse Glimmer aujourd’hui. Tout le reste attend. Si vous aviez prévu un achat de GPU autour de ce modèle, attendez que le support arrive réellement plutôt que d’acheter sur la foi d’une phrase de feuille de route.
Ollama affirme que son moteur MLX offre des performances de premier plan sur Apple Silicon pour ce modèle. C’est leur affirmation, pas un benchmark reproduit de façon indépendante, et elle vaut ce que vaut une déclaration d’éditeur en attendant des chiffres tiers.
Récupérer et lancer le modèle
La commande documentée est courte :
ollama run muse-glimmer:30b-mlx
Le suffixe -mlx dans le tag n’est pas décoratif. Il indique précisément quel moteur cette build cible, et c’est un rappel utile de la raison pour laquelle ce tag ne vous servira à rien sur un serveur Linux avec une 3090 dedans.
Le brancher à des agents de code et des assistants
La partie que je trouve plus intéressante que le modèle lui-même, c’est le jeu de commandes ollama launch livré avec. Ollama documente Muse Glimmer comme backend de plusieurs applications d’agents, toutes tournant entièrement sur votre propre matériel :
ollama launch claude --model muse-glimmer:30b-mlxpour Claude Codeollama launch pi --model muse-glimmer:30b-mlxpour Pi, un agent de code plus léger de pi.devollama launch openclaw --model muse-glimmer:30b-mlxpour OpenClawollama launch hermes --model muse-glimmer:30b-mlxpour Hermes
OpenClaw et Hermes sont présentés comme des assistants personnels longue durée plutôt que comme des outils de code. Ollama cite aussi Codex parmi les applications d’agents de code qu’il peut servir. Le point commun, c’est que le modèle reste sur votre machine : le code que votre agent lit et le contexte qu’il accumule ne quittent jamais le réseau local.
Cela prolonge une direction que nous avions couverte le mois dernier, quand Ollama a transformé sa CLI brute en agent interactif par défaut. Le schéma est constant : Ollama consacre ses versions à la plomberie des agents plutôt qu’à l’expérience de conversation.
Faut-il agir maintenant
Si vous utilisez un Mac Studio ou un MacBook bien doté comme machine d’inférence locale, voilà une raison de mettre Ollama à jour cette semaine et de regarder comment un modèle multimodal 30B se comporte sur vos vrais workflows d’agents. Testez-le sur une tâche réelle, pas sur un prompt de démonstration.
Tous les autres peuvent mettre Ollama à jour pour les raisons habituelles et garder un œil sur le flux des versions. Passer en 0.32.7 n’a aucun inconvénient, mais il n’y a pas de Muse Glimmer dedans pour vous.
Si vous montez encore la stack sous-jacente, notre fiche Ollama couvre les bases, et Open WebUI reste le moyen le plus simple de poser une interface navigateur devant le modèle que vous finirez par utiliser.
Le détail complet se trouve dans les notes de version officielles de la v0.32.7 sur GitHub.