Ollama, la plateforme d'intelligence artificielle open source populaire, a intégré une mise à jour clé pour son backend MLX. Cette évolution promet d'optimiser les performances sur les Mac équipés de puces Apple et de corriger des problèmes de compatibilité, une avancée très attendue par la communauté des développeurs.

Ollama, l'outil qui permet d'exécuter des modèles de langage comme Llama et Mistral en local sur votre machine, a fait un pas important pour ses utilisateurs de Apple Silicon. Le 19 août 2026, l'équipe de développement a fusionné la pull request #17850 dans le dépôt principal, qui met à jour le backend MLX, le framework d'apprentissage automatique optimisé pour les puces M1, M2, M3 et supérieures.

Qu'est-ce que MLX et pourquoi cette mise à jour est-elle importante ?

MLX est un framework créé par Apple pour accélérer l'exécution de modèles d'IA sur son matériel. En intégrant cette mise à jour, Ollama vise à améliorer la vitesse d'inférence et la stabilité sur les Mac. Le changement le plus notable est l'incorporation temporaire d'un correctif provenant du projet ml-explore/mlx-c (issue #127), qui résout un problème de compatibilité détecté dans les versions récentes.

Selon le commit 00b18be, la modification affecte 8 fichiers avec 108 ajouts et 4 suppressions. Le développeur principal, Daniel Hiltgen (alias dhiltgen), a expliqué qu'il s'agit d'une mesure transitoire : « Temporarily carry ml-explore/mlx-c#127 ».

Détails techniques et revue

La pull request a été examinée et approuvée par Jesse Gross (jessegross), un autre des contributeurs principaux du projet. Après la fusion, 17 vérifications d'intégration continue ont été exécutées, toutes réussies. De plus, la branche de développement mlx_bump a été supprimée et un suivi supplémentaire a été ouvert : le PR #17874 pour « plomber le correctif temporaire dans les étapes Docker », ce qui garantit que la solution atteindra également les conteneurs.

« Cette mise à jour est un pas en avant pour consolider Ollama comme l'option préférée sur le matériel Apple », a commenté un membre de la communauté dans le fil GitHub.

Pour les utilisateurs, l'amélioration sera particulièrement visible lors du chargement de modèles volumineux et de la réponse en temps réel pendant les conversations avec des assistants locaux.

Données clés de la mise à jour
ParamètreValeur
Date de fusion19 août 2026
Numéro de PR#17850
Fichiers modifiés8
Lignes ajoutées108
Lignes supprimées4
Correctif temporaireml-explore/mlx-c#127
Relecteurjessegross

La mise à jour est déjà disponible sur la branche principale d'Ollama. Ceux qui compilent à partir du code source ou utilisent des versions de développement peuvent donc en profiter immédiatement. On s'attend à ce que la prochaine version stable inclue ces changements officiellement.

Ollama continue de se consolider comme l'un des outils les plus utilisés pour exécuter de l'IA localement, avec plus de 179 000 étoiles sur GitHub et une communauté active qui stimule des améliorations constantes.