À retenir : – la puce m5 est une refonte pour l’ia locale – génération d’images 3,8 fois plus rapide que la m4 – nouveaux accélérateurs neuronaux intégrés au gpu – amélioration de la bande passante mémoire de 28% – possibilité d’exécuter des modèles complexes sur un macbook pro
Apple met en lumière la puissance de sa puce M5 dédiée à l’intelligence artificielle locale. La société a récemment publié une analyse technique qui confirme les attentes de nombreux observateurs : la nouvelle puce M5 sur Mac n’est pas seulement une mise à jour, mais une réinvention conçue spécifiquement pour optimiser l’IA locale. Grâce à son framework open source MLX, Apple illustre que la M5 creuse un fossé significatif par rapport à la génération précédente.
L’un des aspects les plus impressionnants concerne la création d’images. En effet, la puce M5 génère des visuels 3,8 fois plus rapidement que sa prédécesseure, la M4. Cette avancée considérable n’est pas le fruit du hasard; elle résulte d’une toute nouvelle architecture matérielle. Apple a intégré de nouveaux accélérateurs neuronaux dans le GPU (unité graphique) spécifiquement dédiés aux opérations mathématiques nécessaires aux algorithmes de création d’images.
Concernant les grands modèles de langage (LLM), bien que le gain soit moins prononcé, il reste tout aussi important pour garantir une fluidité optimale. Des tests effectués sur des modèles tels que Qwen ou GPT-OSS d’OpenAI indiquent une amélioration variant entre 19 % et 27 % lors de la génération textuelle. Ici, ce n’est pas tant le calcul brut qui est privilégié que plutôt la rapidité avec laquelle circulent les données. Étant donné que l’inférence textuelle est fortement influencée par les capacités mémoires, la puce M5 bénéficie d’une augmentation significative de sa bande passante mémoire avec un total atteignant 153 Go/s contre 120 Go/s pour son prédécesseur.
Avec cette mémoire renforcée, le framework MLX permet au processeur d’opérer sans ralentissements notables, optimisant ainsi les interactions avec les assistants locaux. Au-delà des performances pures en matière de vitesse, Apple souligne également l’aptitude réelle de ses machines à exécuter ces intelligences artificielles locales. Grâce à un processus appelé quantification – qui permet de compresser les modèles IA – un MacBook Pro équipé de 24 Go de RAM peut faire fonctionner aisément un modèle contenant jusqu’à 30 milliards de paramètres tout en maintenant son empreinte mémoire en dessous des 18 Go.
Cela ouvre donc des possibilités intéressantes : les développeurs peuvent désormais exécuter directement sur leur machine des modèles complexes provenant notamment de Hugging Face sans avoir besoin d’envoyer leurs données vers le cloud. Avec cette avancée apportée par la puce M5, l’utilisation concrète et efficace de l’intelligence artificielle locale passe du stade expérimental à celui d’un outil véritablement viable et rapide pour diverses applications pratiques.
Grand maitre Goa'uld des dessins animés, j'ai beaucoup aidé sur l'ancienne version du site de 2002 et je reviens filer un coup de main quand j'ai du temps.