AccueilMatériel IAMac Studio M5 Max / M5 Ultra

Mac Studio M5 Max / M5 Ultra : test et avis pour l'IA locale

La première machine grand public qui fait tourner un modèle frontier en local. On regarde ce qui compte pour faire tourner des LLM en local : mémoire, bande passante, vitesse, prix — et pour qui c'est (ou non) le bon achat.

Mis à jour le 29/08/2026

Où l'acheter

Mac Studio M5 Max (36 Go / 512 Go)
DartyVoir le prix (précommande) →

Précommande — livré dès le 22/09/2026. Paliers 64-512 Go : BTO Apple Store uniquement.

Liens affiliés — QuelLLM peut percevoir une commission sur les achats, sans surcoût pour vous, ce qui n'influence pas ces recommandations (établies de façon indépendante). En tant que Partenaire Amazon, QuelLLM réalise un bénéfice sur les achats remplissant les conditions requises.

Fiche technique

Pour qui ?

Devs et créateurs macOS visant de gros LLM à poste fixe — de la classe 30B (36 Go) jusqu'aux MoE frontier ~600B en Q4 (512 Go).

Avantages et limites

✓ Points forts

  • 512 Go de mémoire unifiée à 1,2 To/s : un modèle de ~600 milliards de paramètres (Q4) tient EN ENTIER en local — inédit hors serveur
  • Apple annonce jusqu'à 4,3× les perfs IA de la génération précédente (Neural Accelerators par cœur GPU)
  • macOS + MLX : l'écosystème LLM local le plus optimisé côté Apple (LM Studio, Ollama, mlx-lm)
  • Silencieux, compact, faible conso pour la capacité — aucune tour multi-GPU ne loge 512 Go de VRAM
  • Thunderbolt 5 et SSD PCIe Gen 6 : chargement des poids nettement plus rapide

✗ Limites

  • Le palier 512 Go n'expédie que fin octobre 2026 (le reste dès le 22/09)
  • Prix Apple : la config 512 Go dépasse largement les 10 000 € — réservée aux usages pro sérieux
  • En dessous de 96 Go, un Mac Studio M4 Max déstocké (2 219 €) ou un mini-PC Strix Halo 128 Go (≈ 3 800 €) offrent plus de mémoire par euro
  • Pas de CUDA : le fine-tuning lourd et certains outils restent plus simples côté NVIDIA

Quel palier de mémoire pour quels modèles ?

La règle : la mémoire fixe la taille du modèle chargeable, la bande passante fixe la vitesse de génération. Vitesses données en ordre de grandeur pour la génération de texte (décodage), quantification Q4, via MLX / llama.cpp — les MoE ne sollicitent que leurs paramètres actifs, d'où leurs débits élevés.

ConfigurationBande passanteCe qui tourne (Q4)Vitesse estimée
M5 Max 36 Go460 Go/sClasse 30B : Qwen3-32B, GLM-4.7-Flash~25-35 tok/s
M5 Max 64 Go614 Go/s (GPU 40 c.)70B en Q4 (~40 Go) ; MoE 30B-A3B très rapides~13-16 tok/s (70B) · 80+ tok/s (MoE A3B)
M5 Max 128 Go614 Go/s70B en Q8, GPT-OSS-120B (MXFP4), contexte long~40-60 tok/s (GPT-OSS-120B)
M5 Ultra 96 Go1,2 To/s70B en Q4 avec de la marge de contexte~25-30 tok/s
M5 Ultra 256 Go1,2 To/sQwen3-235B-A22B en Q4 (~135 Go)~25-35 tok/s
M5 Ultra 512 Go1,2 To/sMoE frontier ~600B en Q4 (classe DeepSeek, ~380-400 Go)~15-20 tok/s

Le préfill (lecture du prompt) profite en plus des Neural Accelerators du GPU M5 — c'était le point faible historique des Mac face aux GPU NVIDIA sur les longs contextes.

M5 Max ou M5 Ultra ?

Le M5 Max (2 999 € en 36 Go, BTO jusqu'à 128 Go) couvre tout ce qui va jusqu'au 70B et aux MoE ~120B : c'est le choix rationnel pour un usage dev/copilote/RAG exigeant. Prenez impérativement le GPU 40 cœurs dès que vous dépassez 36 Go : la bande passante passe de 460 à 614 Go/s, soit un tiers de vitesse en plus sur chaque token.

Le M5 Ultra (6 599 € en 96 Go) ne se justifie que pour sa mémoire : à 96 Go il fait à peine mieux qu'un M5 Max 128 Go moins cher. Sa vraie raison d'être, ce sont les paliers 256 et 512 Go — les seuls à ouvrir les MoE de 235 à ~600 milliards de paramètres. Si vous n'avez pas un usage précis pour ces modèles, l'Ultra est un mauvais achat ; si vous en avez un, c'est le seul matériel de bureau qui le fait.

Face aux alternatives

MachineMémoireBande passantePrixLe bon usage
Mac Studio M4 Max36 Go410 Go/s2 219 € (déstockage)La classe 30B au meilleur prix Apple
Mac Studio M5 Max36-128 Go460-614 Go/sdès 2 999 €70B et MoE ~120B rapides, écosystème MLX
Mac Studio M5 Ultra96-512 Go1,2 To/sdès 6 599 €MoE 235-600B : sans équivalent bureau
Mini-PC Strix Halo64-128 Go212 Go/s≈ 2 300-3 800 €Le meilleur rapport mémoire/euro (70B lent mais accessible)
NVIDIA DGX Spark128 Go273 Go/s≈ 7 790 €Écosystème CUDA obligatoire, fine-tuning
RTX 509032 Go1,79 To/s≈ 5 000 €La vitesse brute jusqu'à ~32B, pas au-delà

En résumé : vitesse pure sur petits modèles → GPU dédié ; capacité maximale par euro → Strix Halo ; capacité maximale tout court → M5 Ultra.

Précommande : ce qu'il faut savoir

Verdict

Le Mac Studio M5 change la catégorie : jusqu'ici, « faire tourner un modèle frontier » voulait dire un serveur multi-GPU hors de prix ; le M5 Ultra 512 Go le fait sur un bureau, en silence. À 2 999 €, le M5 Max 36 Go est correct mais c'est le M4 Max déstocké à 2 219 € qui gagne ce palier ; le M5 prend tout son sens à partir de 128 Go (614 Go/s), et devient unique au monde à 256-512 Go. Si votre usage tient dans 70B, un Strix Halo 128 Go reste 2× moins cher ; si vous voulez la classe DeepSeek en local, il n'y a tout simplement rien d'autre.

Questions fréquentes

Le Mac Studio M5 Max / M5 Ultra peut-il faire tourner un LLM 70B en local ?

36 Go : classe 30B · 64-96 Go : 70B en Q4 · 128 Go : GPT-OSS-120B à l'aise · 256 Go : Qwen3-235B (MoE) · 512 Go : MoE frontier ~600B en Q4, classe DeepSeek — cf. tableau des paliers.

Combien coûte le Mac Studio M5 Max / M5 Ultra ?

Compter 2 999 € (M5 Max 36 Go / 512 Go) · 6 599 € (M5 Ultra 96 Go / 1 To) — jusqu'à ≈ 20 000 € en 512 Go / 16 To (dès 2 499 $ (M5 Max) · 5 499 $ (M5 Ultra)). Les prix varient vite — vérifiez le prix du jour via les liens d'achat.

Pour qui le Mac Studio M5 Max / M5 Ultra est-il fait ?

Devs et créateurs macOS visant de gros LLM à poste fixe — de la classe 30B (36 Go) jusqu'aux MoE frontier ~600B en Q4 (512 Go).

Peut-on faire tourner un modèle de classe DeepSeek en local sur le Mac Studio M5 ?

Oui, c'est LA nouveauté : en 512 Go de mémoire unifiée, un MoE frontier de ~600 milliards de paramètres quantifié en Q4 (~380-400 Go de poids) tient en entier, avec une génération estimée à 15-20 tok/s grâce à l'architecture MoE (seuls les paramètres actifs sont lus à chaque token). Voir aussi notre guide DeepSeek V4 Flash.

Faut-il attendre le M5 ou prendre le Mac Studio M4 Max déstocké ?

Si votre besoin tient dans 36 Go (classe 30B), le M4 Max à 2 219 € est le meilleur coup : 780 € de moins pour ~10 % de vitesse en moins. Dès que vous visez 64 Go et plus, partez sur le M5 — bande passante supérieure, Neural Accelerators, et des paliers mémoire que le M4 Max n'a plus.

Pourquoi la mémoire unifiée bat-elle un GPU pour les gros modèles ?

Un GPU dédié plafonne à 32 Go de VRAM (RTX 5090) : au-delà, il faut décharger sur la RAM via le bus PCIe et la vitesse s'effondre. La mémoire unifiée Apple donne au GPU un accès direct à la totalité des 96-512 Go : le modèle entier reste à pleine bande passante. C'est plus lent qu'une VRAM GDDR7 à taille égale, mais c'est la seule approche de bureau qui « loge » les modèles géants.

Pour aller plus loin