Apple a présenté hier ses nouveaux Mac mini M6, Mac mini M5 Pro, Mac Studio M5 Max et Mac Studio M5 Ultra. Les prix décollent, les fiches techniques impressionnent, la presse tech recopie les slides. Personne ne dit ce qui se joue vraiment.
Sous les 12 429 EUR d’un Mac Studio M5 Ultra 256 Go, Apple vient de signer un pivot stratégique que personne ne voyait il y a dix-huit mois. La marque assume désormais publiquement le positionnement Mac agentique toujours actif. Traduction sans langue de bois : votre Mac devient un serveur d’inférence IA à domicile, et Nvidia ne peut littéralement pas suivre sur ce terrain.
Voilà l’histoire.
Sommaire
- Ce qu’Apple a réellement annoncé
- Le pivot que personne ne voulait annoncer
- M6 et M5 Ultra, deux jeux différents
- L’exploit silicium que personne ne prend au sérieux
- Le cluster RDMA à 2 To, la bombe cachée
- Apple contre Nvidia, le calcul qui dérange
- Les prix, contrepartie assumée
- Quel Mac pour quel usage IA
- Verdict
Ce qu’Apple a réellement annoncé
Deux nouvelles puces, quatre nouvelles machines, une seule date de livraison : le 22 septembre.
- Puce M6 : gravure 2 nm, 12 cœurs CPU (2 super, 4 performance, 6 efficacité), 12 cœurs GPU avec Neural Accelerator sur chaque cœur, deux Neural Engines de 16 cœurs, jusqu’à 32 Go de mémoire unifiée à 170 Go/s.
- Puce M5 Ultra : architecture à quatre dies via UltraFusion nouvelle génération, 36 cœurs CPU, 80 cœurs GPU, jusqu’à 512 Go de mémoire unifiée à 1,2 To/s, interconnexion inter-dies supérieure à 4,4 To/s.
- Mac mini M6 : 1 049 EUR de base (16 Go / 256 Go), livré le 22 septembre.
- Mac mini M5 Pro : 1 999 EUR (24 Go / 512 Go), 22 septembre.
- Mac Studio M5 Max : 2 999 EUR (36 Go / 512 Go), 22 septembre.
- Mac Studio M5 Ultra : 6 599 EUR (96 Go / 1 To), 22 septembre. Configuration 512 Go disponible fin octobre, prix pas encore communiqué.
Ces chiffres ne racontent rien tant qu’on ne comprend pas ce qu’Apple vient de faire à Nvidia.
Le pivot que personne ne voulait annoncer
Le communiqué Apple est explicite pour la première fois. Le Mac mini devient officiellement the leading desktop for always-on agentic computing. Traduit du marketing, Apple positionne le Mac mini comme un serveur d’agents IA permanents. Cette phrase n’existait pas il y a douze mois.
Tim Cook a même fait un aveu rare. La pénurie du Mac mini M4 depuis douze mois vient d’une demande IA locale qui a dépassé toutes les prévisions internes. Les utilisateurs de LM Studio, Ollama et OpenClaw ont fait exploser un marché qu’Apple n’avait pas vu venir. Cupertino ajuste sa production et ses prix. Et surtout son discours.
Le Mac mini n’est plus un ordinateur d’appoint. C’est le point d’entrée pour héberger votre propre modèle chez vous, sans compter les tokens de personne.
Apple a mis dix-huit mois à assumer ce pitch en public. Maintenant qu’il est acté, la gamme entière se réorganise autour.
Le storytelling n’est pas anodin. Cook a sorti sa dernière annonce hardware par communiqué, un lundi de fin août à 15 heures, six jours avant de passer la main à John Ternus. La keynote iPhone de septembre sera vide de nouveautés Mac. Le patron sortant n’a pas voulu partager la scène.
M6 et M5 Ultra, deux jeux différents
Le point qui déroute la presse tech grand public. Apple annonce simultanément une puce M6 et une puce M5. Le chiffre le plus élevé n’est pas la plus puissante. C’est le nouveau modèle Apple.
Plus radical encore. Il n’y aura jamais de M6 Pro, ni Max, ni Ultra. La M6 restera cantonnée au Mac mini de base et au prochain MacBook Pro 14 pouces d’entrée de gamme. Le reste de la gamme attend le M7 fin 2027, avec Pro, Max et Ultra livrés d’un bloc. Apple saute purement et simplement une génération entière sur le haut de gamme.
Traduction pour les créatifs pros équipés en M3 Ultra : votre machine va tenir jusqu’à fin 2027. Le M7 arrivera avec une avance telle qu’un M6 Pro serait un pansement inutile.
La M6 démocratise, la M5 Ultra domine.
La M6 vise la masse. Bureautique musclée, développement, agents locaux permanents, petits et moyens modèles jusqu’à environ 15 milliards de paramètres en 4 bits. Ses deux super cœurs traitent les tâches à latence critique, ses quatre cœurs de performance gèrent le multithread, ses six cœurs à haute efficacité tournent en arrière-plan sans réveiller la ventilation.
La M5 Ultra vise les modèles massifs. Un modèle de 405 milliards de paramètres en 4 bits pèse environ 203 Go de poids purs. Difficile à envisager sur un H100 seul. Trivial sur un Mac Studio M5 Ultra 512 Go. C’est là que tout se joue.
| Puce | CPU max | GPU max | Mémoire max | Bande passante |
|---|---|---|---|---|
| M6 | 12 cœurs | 12 cœurs | 32 Go | 170 Go/s |
| M5 Pro | 18 cœurs | 20 cœurs | 64 Go | 307 Go/s |
| M5 Max | 18 cœurs | 40 cœurs | 128 Go | 614 Go/s |
| M5 Ultra | 36 cœurs | 80 cœurs | 512 Go | 1,2 To/s |
L’exploit silicium que personne ne prend au sérieux
La M5 Ultra n’est pas juste une puce plus grosse. C’est un assemblage de quatre dies distincts que macOS voit comme un processeur unique.
Chaque M5 Max intègre déjà deux dies reliés en interne. UltraFusion nouvelle génération relie ensuite deux ensembles M5 Max pour former le SoC final. Résultat, quatre dies, un espace mémoire unifié, une interconnexion inter-dies supérieure à 4,4 To/s, une densité de connexion six fois supérieure à la génération précédente.

Comparaison utile. Les architectures multi-GPU Nvidia demandent un développement logiciel spécifique pour répartir un modèle entre plusieurs cartes. Ici, l’application voit un GPU de 80 cœurs et 512 Go de mémoire. Le découpage est géré par le silicium.
Cette architecture ouvre un chapitre plus intéressant.
Le cluster RDMA à 2 To, la bombe cachée
Apple confirme le RDMA sur Thunderbolt 5 entre plusieurs Mac Studio. RDMA veut dire Remote Direct Memory Access. Traduction concrète, une machine accède directement à la mémoire d’une autre sans passer par la pile réseau traditionnelle.
Avant RDMA, un cluster de Mac Studio tournait jusqu’à 91 % plus lentement qu’une seule machine. Les communications entre nœuds tuaient tout gain de calcul. Avec RDMA, la latence chute d’environ 300 microsecondes à 3 microsecondes. Le tensor parallelism devient exploitable.
Quatre Mac Studio M5 Ultra 512 Go reliés en Thunderbolt 5, ça donne 2 To de mémoire unifiée accessible à un seul modèle. Une infrastructure d’inférence dans un mètre cube de bureau.
L’exemple concret existe déjà. NetworkChuck a testé la configuration en décembre 2025 avec 2 To de mémoire, 320 cœurs GPU, 32 To de stockage. Chaque nœud communique directement avec les trois autres via six câbles Thunderbolt 5. L’Ethernet reste utilisé pour la découverte et le téléchargement de modèles, TB5 transporte les échanges sensibles à la latence.
Apple revendique jusqu’à 3x de performance d’inférence avec quatre systèmes. Ce n’est pas une multiplication par quatre, parce que découper un modèle a un coût. Mais c’est suffisant pour faire tourner Qwen3.8-Max quantifié, un modèle Mixture of Experts de 2,4 billions de paramètres.
Aucun autre constructeur mainstream ne propose ça.
Apple contre Nvidia, le calcul qui dérange
Nvidia n’est pas menacée sur l’entraînement. Les LLM frontière sont entraînés sur des dizaines de milliers de H100 et B200. Le moat CUDA est réel, l’écosystème mature, les performances brutes écrasantes. Le H100 délivre 1 979 TFLOPS en FP16, la M3 Ultra environ 27 TFLOPS. Personne n’entraînera GPT-6 sur des Mac Studio.
Le vrai combat se joue ailleurs. L’inférence locale à grande capacité mémoire, pour un utilisateur isolé ou un petit lab. Là, le calcul devient embarrassant pour Nvidia.
Coût par gigaoctet de mémoire accessible au modèle :
- Nvidia H100 80 Go : environ 30 000 EUR HT, soit 375 EUR par Go.
- Nvidia B300 avec 288 Go HBM3e : environ 35 000 EUR, soit 120 EUR par Go.
- Mac Studio M5 Ultra 256 Go : 12 429 EUR TTC, soit 49 EUR par Go.
- Cluster de 4 Mac Studio M5 Ultra 512 Go : environ 26 000 EUR estimés, soit 13 EUR par Go pour 2 To de mémoire cumulée.
À usage égal pour l’inférence d’un modèle de 400 milliards de paramètres en 4 bits, un H100 80 Go ne suffit pas. Il en faut deux ou trois, soit 60 000 à 100 000 EUR de silicium Nvidia plus le serveur autour. Un seul Mac Studio M5 Ultra 512 Go fait le job. Quand la capacité prime sur la vitesse, le rapport de force s’inverse.
Nvidia gagne quand il faut servir 10 000 requêtes par seconde à des utilisateurs cloud. Apple gagne quand il faut héberger le modèle chez soi, en silence, sur une seule machine de 4 kilos. Deux marchés. Deux jeux. Nvidia domine le sien. Apple vient d’inventer l’autre.
Ce que ça libère au passage, c’est la souveraineté sur les données par le hardware. Vos poids restent chez vous, l’inférence tourne sans réseau, aucun fournisseur cloud ne peut couper l’accès ou changer sa politique de contenu du jour au lendemain. Apple livre exactement la promesse que l’AI Act européen mettra sept ans à réguler.
Les prix, contrepartie assumée
Cette révolution silencieuse a un prix. Littéralement.
Le Mac mini de base coûte 1 049 EUR contre 699 EUR pour le M4 à son lancement. C’est 50 % de plus en dix-huit mois. Le Mac Studio Ultra passe de 4 999 EUR (M3 Ultra) à 6 599 EUR (M5 Ultra), soit 32 % de plus. La configuration Mac Studio M5 Ultra 256 Go / 1 To atteint 12 429 EUR. La 512 Go arrivera fin octobre à un prix pas encore communiqué. Le maximum théorique aujourd’hui, avec 16 To de SSD, se chiffre à 20 679 EUR.
Apple justifie officiellement par la pénurie et l’inflation du prix de la mémoire. HBM3, HBM3e et LPDDR5X sont effectivement en tension mondiale. C’est vrai mais partiel. La demande IA locale a démontré qu’Apple pouvait tenir ces prix sans perdre le marché. Cupertino ajuste sa marge en conséquence.
Le Mac mini M6 à 1 049 EUR reste moins cher qu’un H100. C’est le seul benchmark qui compte.
Quel Mac pour quel usage IA
Le vrai guide d’achat, sans commissions ni langue de bois.
Tester l’IA locale sans investir : Mac mini M6 24 Go / 512 Go, 1 489 EUR. La version 24 Go apporte 11 % de bande passante en plus que la 16 Go, et permet de charger confortablement un modèle de 7 à 8 milliards de paramètres en 4 bits (Mistral 7B, Llama 3.2 8B, Gemma 3 12B). Le SSD 512 Go devient vite obligatoire dès qu’on empile plusieurs modèles. C’est le meilleur ratio prix/utilité pour découvrir Ollama, LM Studio ou un agent local permanent.
Dev sérieux ou agent en production : Mac mini M5 Pro 48 Go / 1 To, autour de 2 700 EUR. 48 Go de mémoire à 307 Go/s, Thunderbolt 5, silencieux, capable de faire tourner Mistral Large en quantifié tout en laissant Xcode compiler à côté. Le rapport encombrement sur puissance reste imbattable pour un poste développeur.
Prod créative avec IA lourde : Mac Studio M5 Max 64 Go / 2 To, autour de 4 500 EUR. Même famille de puce que le MacBook Pro pour 2 100 EUR de moins, à condition d’avoir déjà écran et périphériques. GPU 40 cœurs, refroidissement sérieux, capable de tenir la charge sur un rendu 3D, un montage 8K ou une inférence prolongée.
Recherche IA ou lab isolé : Mac Studio M5 Ultra 256 Go, 12 429 EUR. La configuration à considérer si l’objectif est de faire tourner un modèle 70B en 8 bits ou 405B en 4 bits sur une seule machine. Aucun équivalent Nvidia à ce prix.
Infrastructure sérieuse : cluster de 4 Mac Studio M5 Ultra 512 Go, à partir de 26 000 EUR estimés. Deux téraoctets de mémoire unifiée, Qwen3.8-Max jouable, alternative crédible aux serveurs Nvidia à 100 000 EUR et plus. Public de niche, labs de recherche et entreprises qui refusent le cloud.
Verdict
Apple ne joue plus le même jeu que Nvidia. Cupertino vient de gagner un jeu que Nvidia ne joue pas.
L’inférence locale à grande capacité mémoire pour un utilisateur unique, à un prix qui rend la démarche viable pour un pro isolé ou un lab qui refuse le cloud. Personne d’autre ne propose ça avec cette maturité.
Le Mac cesse d’être un ordinateur. Il devient le substrat mainstream de l’ère post-cloud pour l’inférence IA. Le hardware fait le boulot que sept ans d’AI Act européen n’ont pas fait. Rendre la souveraineté effective pour ceux qui la veulent vraiment.
Reste la question qui pique. À 1 049 EUR pour le mini d’entrée et 12 429 EUR pour le Studio 256 Go, Apple assume que ce marché acceptera de payer. Pour l’instant, la demande valide la tarification. Rendez-vous dans six mois pour voir si la courbe des ventes suit.
Si cet article t’a été utile, n’hésite pas à me le dire en commentaire. Tu peux aussi soutenir le blog en faisant tes achats Amazon via ce lien.





Laisser un commentaire