A plataforma de inteligência artificial de código aberto Ollama lançou uma atualização significativa para seu backend MLX, otimizando o desempenho em Macs com chip da Apple. A mudança corrige problemas de compatibilidade e promete maior velocidade, um avanço muito aguardado pela comunidade de desenvolvedores.

Ollama, a ferramenta que permite executar modelos de linguagem como Llama e Mistral diretamente em computadores locais, deu um passo importante para usuários de Apple Silicon. No 19 de agosto de 2026, a equipe de desenvolvimento incorporou o pull request #17850 ao repositório principal, atualizando o backend MLX, o framework de aprendizado de máquina otimizado para os chips M1, M2, M3 e superiores.

O que é MLX e por que essa atualização é importante?

MLX é um framework criado pela Apple para acelerar a execução de modelos de IA em seu hardware. Com essa integração, o Ollama busca melhorar a velocidade de inferência e a estabilidade em dispositivos Mac. A mudança mais relevante é a incorporação temporária de um patch do projeto ml-explore/mlx-c (issue #127), que resolve um problema de compatibilidade detectado em versões recentes.

De acordo com o commit 00b18be, a modificação afeta 8 arquivos, com 108 adições e 4 remoções. O desenvolvedor principal, Daniel Hiltgen (conhecido como dhiltgen), explicou que se trata de uma medida temporária: “Temporarily carry ml-explore/mlx-c#127”.

Detalhes técnicos e revisão

O pull request foi revisado e aprovado por Jesse Gross (jessegross), outro colaborador principal do projeto. Após a fusão, foram executadas 17 verificações de integração contínua, todas bem-sucedidas. Além disso, a branch de desenvolvimento mlx_bump foi removida e um acompanhamento adicional foi aberto: o PR #17874 para “plumbar o patch temporário nas etapas do Docker”, garantindo que a solução também chegue aos contêineres.

“Essa atualização é um passo à frente para consolidar o Ollama como a opção preferida no hardware da Apple”, comentou um membro da comunidade no tópico do GitHub.

Para os usuários, a melhoria será perceptível especialmente no carregamento de modelos grandes e na resposta em tempo real durante conversas com assistentes locais.

Dados principais da atualização
ParâmetroValor
Data da fusão19 de agosto de 2026
Número do PR#17850
Arquivos modificados8
Linhas adicionadas108
Linhas removidas4
Patch temporárioml-explore/mlx-c#127
Revisorjessegross

A atualização já está disponível na branch principal do Ollama, portanto quem compila a partir do código-fonte ou utiliza versões de desenvolvimento pode aproveitá-la imediatamente. Espera-se que a próxima versão estável inclua essas mudanças oficialmente.

O Ollama continua se consolidando como uma das ferramentas mais usadas para executar IA localmente, com mais de 179.000 estrelas no GitHub e uma comunidade ativa que impulsiona melhorias constantes.