Ollama, die beliebte Open-Source-Plattform für künstliche Intelligenz, hat ein wichtiges Update für ihr MLX-Backend eingeführt. Die Änderung verspricht eine optimierte Leistung auf Macs mit Apple-Chip und behebt Kompatibilitätsprobleme – ein lang erwarteter Fortschritt für die Entwickler-Community.

Ollama, das Tool, mit dem Sprachmodelle wie Llama und Mistral lokal ausgeführt werden können, hat einen bedeutenden Schritt für Nutzer von Apple Silicon gemacht. Am 19. August 2026 wurde der Pull-Request #17850 in das Haupt-Repository integriert, der das MLX-Backend aktualisiert – das Framework für maschinelles Lernen, das speziell für die Chips M1, M2, M3 und neuer optimiert ist.

Was ist MLX und warum ist dieses Update wichtig?

MLX ist ein von Apple entwickeltes Framework, das die Ausführung von KI-Modellen auf der eigenen Hardware beschleunigt. Mit dieser Integration will Ollama die Inferenzgeschwindigkeit und die Stabilität auf Mac-Geräten verbessern. Die wichtigste Änderung ist die vorübergehende Übernahme eines Patches aus dem Projekt ml-explore/mlx-c (Issue #127), der ein Kompatibilitätsproblem in neueren Versionen behebt.

Laut dem Commit 00b18be betrifft die Änderung 8 Dateien mit 108 Ergänzungen und 4 Löschungen. Der Hauptentwickler Daniel Hiltgen (Alias dhiltgen) erklärte, dass es sich um eine vorübergehende Maßnahme handelt: „Temporarily carry ml-explore/mlx-c#127“ (deutsch: „Temporär ml-explore/mlx-c#127 übernehmen“).

Technische Details und Überprüfung

Der Pull-Request wurde von Jesse Gross (jessegross), einem weiteren Hauptbeitragenden, geprüft und genehmigt. Nach der Integration wurden 17 Continuous-Integration-Prüfungen erfolgreich ausgeführt. Zusätzlich wurde der Entwicklungszweig mlx_bump entfernt und eine Folgemaßnahme gestartet: der PR #17874, um den temporären Patch auch in Docker-Stufen zu integrieren.

„Dieses Update ist ein Schritt nach vorn, um Ollama als bevorzugte Option auf Apple-Hardware zu etablieren“, kommentierte ein Community-Mitglied im GitHub-Thread.

Für Anwender macht sich die Verbesserung besonders beim Laden großer Modelle und bei der Echtzeit-Antwort bei lokalen Assistenten bemerkbar.

Wichtige Daten des Updates
ParameterWert
Fusionsdatum19. August 2026
PR-Nummer#17850
Geänderte Dateien8
Hinzugefügte Zeilen108
Gelöschte Zeilen4
Temporärer Patchml-explore/mlx-c#127
Prüferjessegross

Das Update ist bereits im Hauptzweig von Ollama verfügbar. Wer aus dem Quellcode kompiliert oder Entwicklerversionen nutzt, kann es sofort verwenden. Es wird erwartet, dass die nächste stabile Version diese Änderungen offiziell enthält.

Ollama etabliert sich weiterhin als eines der meistgenutzten Werkzeuge für lokale KI-Ausführung, mit über 179.000 Sternen auf GitHub und einer aktiven Community, die kontinuierlich Verbesserungen vorantreibt. Weitere Details zum Pull-Request finden Sie unter GitHub PR #17850.