Ollama,这个允许在本地设备上运行 Llama 和 Mistral 等语言模型的工具,为其 Apple Silicon 用户迈出了重要一步。在 2026年8月19日,开发团队将 pull request #17850 合并到了主仓库中,该请求更新了 MLX 后端,这是为 M1、M2、M3 及更高版本芯片优化的机器学习框架。
什么是 MLX,为什么这次更新很重要?
MLX 是 Apple 创建的框架,用于加速其硬件上 AI 模型的运行。通过集成此更新,Ollama 旨在 提高推理速度 和 稳定性 在 Mac 设备上。最相关的变化是临时引入了来自 ml-explore/mlx-c 项目(issue #127)的补丁,该补丁解决了最近版本中发现的兼容性问题。
根据 commit 00b18be,该修改影响了 8 个文件,包含 108 行新增 和 4 行删除。主要开发者 Daniel Hiltgen(别名 dhiltgen)解释说这是一项临时措施:“暂时携带 ml-explore/mlx-c#127”。
技术细节和审查
这个 pull request 由项目的另一位主要贡献者 Jesse Gross(jessegross)审查并批准。合并后,执行了 17 项持续集成检查,全部成功。此外,删除了开发分支 mlx_bump,并开始了额外的跟踪:PR #17874 用于“在 Docker 阶段中梳理临时补丁”,确保该解决方案也能到达容器。
“这次更新是巩固 Ollama 作为 Apple 硬件上首选方案的一步,”一位社区成员在 GitHub 线程中评论道。
对于用户来说,这种改进在 大型模型的加载 和 与本地助手对话时的实时响应 中尤为明显。
更新关键数据
| 参数 | 值 |
|---|---|
| 合并日期 | 2026年8月19日 |
| PR 编号 | #17850 |
| 修改文件数 | 8 |
| 新增行数 | 108 |
| 删除行数 | 4 |
| 临时补丁 | ml-explore/mlx-c#127 |
| 审查者 | jessegross |
该更新已在 Ollama 的主分支上提供,因此从源代码编译或使用开发版本的人可以立即利用它。预计下一个稳定版本将正式包含这些更改。
Ollama 继续巩固其作为本地运行 AI 最常用工具之一的地位,在 GitHub 上拥有超过 179,000 颗星,以及一个推动持续改进的活跃社区。