Ouvrir le menu principal

MacGeneration

Recherche

L'utilitaire de LLM en local Ollama passe à la vitesse supérieure avec MLX

Félix Cattafesta

mardi 31 mars 2026 à 11:03 • 17

Intelligence artificielle

Ollama accélère doucement sa transformation. Ce qui n’était au départ qu’un outil pour lancer des modèles en local depuis le Terminal devient une véritable plateforme plus grand public et plus poussée. Après avoir gagné la possibilité de générer des images, ses développeurs viennent de lui ajouter la prise en charge du framework MLX d’Apple. De quoi grandement améliorer les performances pour ceux ayant des assistants comme OpenClaw ou s’en servant avec Claude Code ou Codex.

Ollama en action.

Ollama passait jusqu’à présent par l'implémentation Metal de llama.cpp, et ce changement de framework lui permet d’optimiser encore plus ses performances sur les appareils Apple Silicon. Tout passer par une meilleure exploitation conjointe du CPU, du GPU et du Neural Engine. Sur les puces M5, M5 Pro et M5 Max, Ollama exploite aussi les nouveaux accélérateurs neuronaux intégrés au GPU, ce qui améliore à la fois le temps de réponse initial et la vitesse de génération.

MLX : un framework de machine learning adapté aux puces Apple

MLX : un framework de machine learning adapté aux puces Apple

De plus, l’utilitaire adopte désormais le format NVFP4 de NVIDIA, conçu pour maintenir un bon niveau de précision tout en réduisant les besoins en mémoire et en bande passante lors de l’exécution des modèles, notamment pour les tâches courantes comme la génération de texte ou l’analyse de données. Cette optimisation concerne surtout les environnements équipés de GPU NVIDIA récents et ouvre la voie à l’exécution de modèles optimisés pour cette technologie.

Sur un autre registre, Ollama fait évoluer son système de cache pour gagner en efficacité sur les usages liés au code et aux agents. La mémoire est mieux optimisée grâce à la réutilisation du cache entre conversations, tandis que des points de sauvegarde intelligents accélèrent le traitement des requêtes. Enfin, la gestion du cache devient plus fine, en conservant plus longtemps les éléments communs entre différentes interactions.

Les évolutions sur Qwen3.5-35B-A3B (la machine n’est pas indiquée).

Cette nouvelle version d’Ollama permet notamment pour l'instant de faire tourner certains modèles exigeants comme Qwen3.5-35B-A3B : elle demande donc un Mac avec au moins 32 Go de RAM. D’autres modèles seront pris en charge par la suite, en plus d’une solution pour importer les modèles custom dans Ollama. Ollama 0.19 peut être téléchargé sur le site des développeurs.

Ajouter ce site dans Google News

Les premiers tests des AirPods 5 saluent surtout leur réduction de bruit

11:59

• 1


MacGeneration a 27 ans : on revient de loin, on continue avec vous

11:47

• 31


Le keynote d’Apple a demandé 38 jours de tournage sur 20 sites différents

10:29

• 9


iPhone 18 Pro : les délais s’allongent aussi, mais Amazon annonce encore une livraison dès samedi

10:08

• 4


L'improbable front commun de la Silicon Valley pour freiner l'IA

09:00

• 16


Homebrew 7 apporte une interface graphique et prépare l’abandon des Mac Intel

08:46

• 20


Claude en renfort, GPT-5.6 aux commandes : les ouvertures cachées de Siri

08:15

• 13


Quand l'Apple Watch se réinvente en mini-téléphone ou en horloge de bureau

07:51

• 6


Quand le SAV d'Apple transforme un vieux Mac Intel en MacBook Air M5

07:40

• 26


iPhone Duo : le pliable va-t-il devenir la norme ?

07:12

• 54


iOS 27 : faites travailler vos appareils Apple ensemble avec notre livre à 4,99 €

13/09/2026 à 23:55

• 8


Une station d'accueil avec 14 ports USB-C !

13/09/2026 à 21:15

• 0


Mourir peut attendre, y compris pour l’iPhone : la semaine Apple

13/09/2026 à 20:50

• 46


Apple Watch Series 12 et Ultra 4 : Apple souligne désormais que la batterie peut être remplacée

13/09/2026 à 20:49

• 45


iPhone 18 Pro Max : déjà jusqu’à un mois d’attente chez Apple, du stock chez Amazon

13/09/2026 à 09:36

• 67


ChatGPT m'a aidé à récupérer 9 To de données, que je pensais avoir perdus après une coupure de courant

13/09/2026 à 08:00

• 56