Ollama dépasse presque la vitesse des LLM sur Mac avec MLX, mais à une condition

Ollama dépasse presque la vitesse des LLM sur Mac avec MLX, mais à une condition

Ollama a opéré une modification majeure de son architecture pour exécuter des modèles d’intelligence artificielle sur les Mac équipés de la puce Apple Silicon. Depuis la version 0.19, il intègre en phase pilote un moteur basé sur MLX, le framework d’apprentissage automatique développé par Apple, capable de faire passer la vitesse de génération du modèle […]