Mac Studio M5 Max / M5 Ultra : test et avis pour l'IA locale
La première machine grand public qui fait tourner un modèle frontier en local. On regarde ce qui compte pour faire tourner des LLM en local : mémoire, bande passante, vitesse, prix — et pour qui c'est (ou non) le bon achat.
Mis à jour le 29/08/2026
Où l'acheter
Précommande — livré dès le 22/09/2026. Paliers 64-512 Go : BTO Apple Store uniquement.
Liens affiliés — QuelLLM peut percevoir une commission sur les achats, sans surcoût pour vous, ce qui n'influence pas ces recommandations (établies de façon indépendante). En tant que Partenaire Amazon, QuelLLM réalise un bénéfice sur les achats remplissant les conditions requises.
Fiche technique
- MémoireM5 Max : 36 à 128 Go · M5 Ultra : 96 à 512 Go unifiés (le palier 512 Go arrive fin octobre)
- Bande passanteM5 Max : 460 Go/s (GPU 32 c.) / 614 Go/s (GPU 40 c.) · M5 Ultra : jusqu'à 1,2 To/s (+50 % vs génération précédente)
- CalculM5 Max : CPU 18 cœurs, GPU jusqu'à 40 cœurs · M5 Ultra : CPU 36 cœurs, GPU 80 cœurs, Neural Engine 32 cœurs — Neural Accelerators dans chaque cœur GPU, Thunderbolt 5, SSD PCIe Gen 6
- ConsoPoste fixe, refroidissement silencieux
- Prix indicatif2 999 € (M5 Max 36 Go / 512 Go) · 6 599 € (M5 Ultra 96 Go / 1 To) — jusqu'à ≈ 20 000 € en 512 Go / 16 To
- Plus gros modèle36 Go : classe 30B · 64-96 Go : 70B en Q4 · 128 Go : GPT-OSS-120B à l'aise · 256 Go : Qwen3-235B (MoE) · 512 Go : MoE frontier ~600B en Q4, classe DeepSeek — cf. tableau des paliers
Pour qui ?
Avantages et limites
✓ Points forts
- 512 Go de mémoire unifiée à 1,2 To/s : un modèle de ~600 milliards de paramètres (Q4) tient EN ENTIER en local — inédit hors serveur
- Apple annonce jusqu'à 4,3× les perfs IA de la génération précédente (Neural Accelerators par cœur GPU)
- macOS + MLX : l'écosystème LLM local le plus optimisé côté Apple (LM Studio, Ollama, mlx-lm)
- Silencieux, compact, faible conso pour la capacité — aucune tour multi-GPU ne loge 512 Go de VRAM
- Thunderbolt 5 et SSD PCIe Gen 6 : chargement des poids nettement plus rapide
✗ Limites
- Le palier 512 Go n'expédie que fin octobre 2026 (le reste dès le 22/09)
- Prix Apple : la config 512 Go dépasse largement les 10 000 € — réservée aux usages pro sérieux
- En dessous de 96 Go, un Mac Studio M4 Max déstocké (2 219 €) ou un mini-PC Strix Halo 128 Go (≈ 3 800 €) offrent plus de mémoire par euro
- Pas de CUDA : le fine-tuning lourd et certains outils restent plus simples côté NVIDIA
Quel palier de mémoire pour quels modèles ?
La règle : la mémoire fixe la taille du modèle chargeable, la bande passante fixe la vitesse de génération. Vitesses données en ordre de grandeur pour la génération de texte (décodage), quantification Q4, via MLX / llama.cpp — les MoE ne sollicitent que leurs paramètres actifs, d'où leurs débits élevés.
| Configuration | Bande passante | Ce qui tourne (Q4) | Vitesse estimée |
|---|---|---|---|
| M5 Max 36 Go | 460 Go/s | Classe 30B : Qwen3-32B, GLM-4.7-Flash | ~25-35 tok/s |
| M5 Max 64 Go | 614 Go/s (GPU 40 c.) | 70B en Q4 (~40 Go) ; MoE 30B-A3B très rapides | ~13-16 tok/s (70B) · 80+ tok/s (MoE A3B) |
| M5 Max 128 Go | 614 Go/s | 70B en Q8, GPT-OSS-120B (MXFP4), contexte long | ~40-60 tok/s (GPT-OSS-120B) |
| M5 Ultra 96 Go | 1,2 To/s | 70B en Q4 avec de la marge de contexte | ~25-30 tok/s |
| M5 Ultra 256 Go | 1,2 To/s | Qwen3-235B-A22B en Q4 (~135 Go) | ~25-35 tok/s |
| M5 Ultra 512 Go | 1,2 To/s | MoE frontier ~600B en Q4 (classe DeepSeek, ~380-400 Go) | ~15-20 tok/s |
Le préfill (lecture du prompt) profite en plus des Neural Accelerators du GPU M5 — c'était le point faible historique des Mac face aux GPU NVIDIA sur les longs contextes.
M5 Max ou M5 Ultra ?
Le M5 Max (2 999 € en 36 Go, BTO jusqu'à 128 Go) couvre tout ce qui va jusqu'au 70B et aux MoE ~120B : c'est le choix rationnel pour un usage dev/copilote/RAG exigeant. Prenez impérativement le GPU 40 cœurs dès que vous dépassez 36 Go : la bande passante passe de 460 à 614 Go/s, soit un tiers de vitesse en plus sur chaque token.
Le M5 Ultra (6 599 € en 96 Go) ne se justifie que pour sa mémoire : à 96 Go il fait à peine mieux qu'un M5 Max 128 Go moins cher. Sa vraie raison d'être, ce sont les paliers 256 et 512 Go — les seuls à ouvrir les MoE de 235 à ~600 milliards de paramètres. Si vous n'avez pas un usage précis pour ces modèles, l'Ultra est un mauvais achat ; si vous en avez un, c'est le seul matériel de bureau qui le fait.
Face aux alternatives
| Machine | Mémoire | Bande passante | Prix | Le bon usage |
|---|---|---|---|---|
| Mac Studio M4 Max | 36 Go | 410 Go/s | 2 219 € (déstockage) | La classe 30B au meilleur prix Apple |
| Mac Studio M5 Max | 36-128 Go | 460-614 Go/s | dès 2 999 € | 70B et MoE ~120B rapides, écosystème MLX |
| Mac Studio M5 Ultra | 96-512 Go | 1,2 To/s | dès 6 599 € | MoE 235-600B : sans équivalent bureau |
| Mini-PC Strix Halo | 64-128 Go | 212 Go/s | ≈ 2 300-3 800 € | Le meilleur rapport mémoire/euro (70B lent mais accessible) |
| NVIDIA DGX Spark | 128 Go | 273 Go/s | ≈ 7 790 € | Écosystème CUDA obligatoire, fine-tuning |
| RTX 5090 | 32 Go | 1,79 To/s | ≈ 5 000 € | La vitesse brute jusqu'à ~32B, pas au-delà |
En résumé : vitesse pure sur petits modèles → GPU dédié ; capacité maximale par euro → Strix Halo ; capacité maximale tout court → M5 Ultra.
Précommande : ce qu'il faut savoir
- Précommandes ouvertes depuis le 25 août 2026, premières livraisons le 22 septembre.
- Le palier 512 Go n'expédie que fin octobre — commandez tôt si c'est votre cible.
- Chez les marchands français, seule la config M5 Max 36 Go / 512 Go est référencée à ce jour (2 999 € chez Darty, livrée dès le 22/09) ; les paliers mémoire supérieurs passent par le configurateur BTO de l'Apple Store.
- Le M4 Max 36 Go reste en déstockage à 2 219 € — voir notre fiche dédiée pour savoir s'il vous suffit.
Verdict
Questions fréquentes
Le Mac Studio M5 Max / M5 Ultra peut-il faire tourner un LLM 70B en local ?
36 Go : classe 30B · 64-96 Go : 70B en Q4 · 128 Go : GPT-OSS-120B à l'aise · 256 Go : Qwen3-235B (MoE) · 512 Go : MoE frontier ~600B en Q4, classe DeepSeek — cf. tableau des paliers.
Combien coûte le Mac Studio M5 Max / M5 Ultra ?
Compter 2 999 € (M5 Max 36 Go / 512 Go) · 6 599 € (M5 Ultra 96 Go / 1 To) — jusqu'à ≈ 20 000 € en 512 Go / 16 To (dès 2 499 $ (M5 Max) · 5 499 $ (M5 Ultra)). Les prix varient vite — vérifiez le prix du jour via les liens d'achat.
Pour qui le Mac Studio M5 Max / M5 Ultra est-il fait ?
Devs et créateurs macOS visant de gros LLM à poste fixe — de la classe 30B (36 Go) jusqu'aux MoE frontier ~600B en Q4 (512 Go).
Peut-on faire tourner un modèle de classe DeepSeek en local sur le Mac Studio M5 ?
Oui, c'est LA nouveauté : en 512 Go de mémoire unifiée, un MoE frontier de ~600 milliards de paramètres quantifié en Q4 (~380-400 Go de poids) tient en entier, avec une génération estimée à 15-20 tok/s grâce à l'architecture MoE (seuls les paramètres actifs sont lus à chaque token). Voir aussi notre guide DeepSeek V4 Flash.
Faut-il attendre le M5 ou prendre le Mac Studio M4 Max déstocké ?
Si votre besoin tient dans 36 Go (classe 30B), le M4 Max à 2 219 € est le meilleur coup : 780 € de moins pour ~10 % de vitesse en moins. Dès que vous visez 64 Go et plus, partez sur le M5 — bande passante supérieure, Neural Accelerators, et des paliers mémoire que le M4 Max n'a plus.
Pourquoi la mémoire unifiée bat-elle un GPU pour les gros modèles ?
Un GPU dédié plafonne à 32 Go de VRAM (RTX 5090) : au-delà, il faut décharger sur la RAM via le bus PCIe et la vitesse s'effondre. La mémoire unifiée Apple donne au GPU un accès direct à la totalité des 96-512 Go : le modèle entier reste à pleine bande passante. C'est plus lent qu'une VRAM GDDR7 à taille égale, mais c'est la seule approche de bureau qui « loge » les modèles géants.