Débutant 11 minMac mini
Quel LLM sur Mac mini M4 / M4 Pro (16–64 Go) ?
Le Mac mini M4 (octobre 2024) est en 2026 le meilleur rapport performance/prix pour faire tourner un LLM en local. À 729 € en version 16 Go et 1599 € en M4 Pro 24 Go, il offre la même puce que le MacBook Pro M4 dans un boîtier de 12 × 12 × 5 cm, totalement silencieux en idle, 30 W max en charge. Un Qwen 3.5 9B y tourne à ~30 tok/s sur le M4 de base, un Qwen 3.6 35B-A3B (MoE) à ~40 tok/s sur M4 Pro. Le guide complet.
#Mac mini M4 / M4 Pro en 2026
- Sortie
- Octobre 2024. Configuration actuelle en 2026 (M5 attendu fin 2026).
- Mac mini M4
- 10 cœurs CPU + 10 cœurs GPU, 120 Go/s, RAM 16, 24 ou 32 Go. Prix 729 à 1229 €.
- Mac mini M4 Pro
- 12 ou 14 cœurs CPU + 16 ou 20 cœurs GPU, 273 Go/s, RAM 24, 48 ou 64 Go. Prix 1599 à 2629 €.
- Format
- 12,7 × 12,7 × 5 cm — plus petit qu'un Mac mini classique. Ventilateur quasi-inaudible en idle.
- Consommation
- 4 W idle, 20-25 W en 7B, 35 W max en pic sur 32B. ~10-15 €/an d'électricité en usage intensif.
→
Le best-value 2026 pour l'IA locale
Mac mini M4 Pro 48 Go à 2199 € : 273 Go/s de bande passante, fait tourner Qwen 3.8 27B à ~15 tok/s et un MoE Qwen 3.6 35B-A3B à ~40 tok/s (3B actifs, donc rapide malgré la taille). Un PC équivalent en perf LLM (avec 48 Go de VRAM unifiée) est impossible à construire à ce prix.
#1. M4 vs M4 Pro : choisir
- Mac mini M4 (120 Go/s)
- Idéal pour 7B-14B. Le 16 Go à 729 € est la porte d'entrée la plus abordable chez Apple pour l'IA locale sérieuse.
- Mac mini M4 Pro (273 Go/s)
- Ouvre 24B-32B confortable, 48 Go RAM accessibles. Pour un serveur LLM maison ou équipe.
- Écart prix (config 24 Go)
- Mac mini M4 24 Go : 929 €. Mac mini M4 Pro 24 Go : 1599 €. +670 € pour 2,3× la bande passante.
- Verdict
- M4 base si usage perso 7B-14B. M4 Pro dès que vous visez 24B+ ou multi-utilisateurs.
#2. Modèles par RAM
Modèles recommandés Mac mini M4 / M4 Pro
| Modèle | Quant | M4 16 | M4 24 | M4 32 | M4 Pro 24 | M4 Pro 48 | M4 Pro 64 |
|---|---|---|---|---|---|---|---|
| Qwen 3.5 9B | Q5_K_M | ✓ 30 | ✓ 32 | ✓ 33 | ✓ 42 | ✓ 44 | ✓ 46 |
| Gemma 4 12B | Q5_K_M | ✓ 14 | ✓ 16 | ✓ 17 | ✓ 23 | ✓ 25 | ✓ 26 |
| Mistral Small 24B | Q4_K_M | — | ✓ 10 | ✓ 11 | ✓ 16 | ✓ 17 | ✓ 18 |
| Devstral 24B (code) | Q4_K_M | — | ✓ 10 | ✓ 11 | ✓ 16 | ✓ 17 | ✓ 18 |
| Qwen 3.8 27B | Q4_K_M | — | — | ✓ 8 | ✓ 12 | ✓ 15 | ✓ 16 |
| Qwen 3.6 35B-A3B (MoE) | Q4_K_M | — | — | ✓ 28 | ✓ 34 | ✓ 40 | ✓ 42 |
| Qwen3-Coder 30B-A3B | Q8_0 | — | — | — | — | ✓ 30 | ✓ 32 |
i
Pour les gros modèles
En 2026, les modèles denses 70B ont laissé la place aux MoE ~30B-A3B (3 milliards de paramètres actifs) : sur Mac mini M4 Pro 48 ou 64 Go, un Qwen 3.6 35B-A3B ou un Qwen3-Coder 30B-A3B tourne en pleine qualité Q8 (~32 Go) à 30-42 tok/s — nettement plus rapide qu'un ancien 70B dense compressé, et sans perte de qualité. Pour aller au-delà (RAM > 96 Go, gros MoE 100B+), il faut un Mac Studio.
#3. Benchmarks 2026
Mac mini M4 Pro 14-core, 48 Go, Ollama 0.5.x
| Modèle | Q4_K_M | Q5_K_M | MLX 4-bit |
|---|---|---|---|
| Qwen 3.5 9B | 46 t/s | 44 t/s | 50 t/s |
| Gemma 4 12B | 27 t/s | 25 t/s | 29 t/s |
| Mistral Small 24B | 18 t/s | 17 t/s | 20 t/s |
| Qwen 3.6 35B-A3B (MoE) | 42 t/s | 40 t/s | 45 t/s |
#4. Installation + serveur LLM
#5. Cas d'usage typiques du Mac mini M4
- Serveur LLM maison
- Un Mac mini M4 Pro 48 Go couvre les besoins d'une famille ou petite équipe (5-10 utilisateurs). Posé près du routeur, exposé en LAN.
- Terminal NAS + IA
- Peut jouer NAS Synology-like (Time Machine, Plex, photos iCloud) + serveur LLM. Une seule machine pour tout.
- Back-end d'apps dev
- API OpenAI-compatible à localhost pour vos scripts, n8n, Cline, Aider. Évite de payer des tokens OpenAI en dev.
- RAG documentaire
- 24B + embeddings multilingues + reranker : tout en RAM sur Mac mini M4 Pro 48 Go. Pour un RAG sérieux (docs internes, legal, médical).
#Mac mini M4 vs MBA M4 vs MBP M4
Config 16 Go équivalente, tokens/sec Qwen 3.5 9B Q5
| Machine | Prix 2026 | 9B tok/s | Throttle | Mobilité |
|---|---|---|---|---|
| Mac mini M4 16 Go | 729 € | 30-33 (soutenu) | Aucun | Non |
| MacBook Air M4 16 Go | 1299 € | 29 (10 min) puis 23 | Oui -20 % | Oui |
| MacBook Pro M4 16 Go | 1899 € | 31 (soutenu) | Aucun | Oui |
→
Règle simple
Mac mini M4 si sédentaire → meilleur euro investi. MBA M4 si portabilité + silence comptent. MBP M4 si portabilité sans compromis.
#Questions fréquentes
Le Mac mini M4 à 729 € est-il vraiment viable pour l'IA locale ?+
Oui. 16 Go de mémoire unifiée, 120 Go/s de bande passante, Qwen 3.5 9B à ~30 tok/s, Gemma 4 12B à ~14 tok/s. Pour un usage perso ou familial, c'est largement suffisant. C'est littéralement l'entrée de gamme Apple pour l'IA locale la plus accessible.
Mac mini M4 24 Go ou 32 Go ?+
24 Go à 929 € couvre la plupart des usages (14B en Q5 confortable). 32 Go à 1229 € n'ouvre pas de palier supplémentaire significatif — n'achetez les 32 Go que si vous avez un usage RAG très gourmand ou si vous voulez tourner deux modèles 14B en parallèle.
Mac mini M4 Pro 48 Go pour un gros modèle ?+
En 2026, plus besoin de viser un 70B dense : un MoE Qwen 3.6 35B-A3B ou un Qwen3-Coder 30B-A3B en pleine qualité Q8 (~32 Go) tient dans 48 Go et tourne à 30-42 tok/s (3B actifs). C'est plus rapide et plus fin qu'un ancien 70B compressé. Pour aller au-delà (gros MoE 100B+), il faut un Mac Studio.
Peut-on utiliser le Mac mini M4 en serveur tête coupée (sans écran) ?+
Oui, et c'est le cas d'usage typique. Configurez en SSH uniquement, désactivez la mise en veille auto, posez-le à côté du routeur. Accédez-y par Screen Sharing si besoin ponctuel d'UI.
Le Mac mini M4 chauffe-t-il ?+
Très peu. Design thermique calibré pour l'inférence soutenue : ~55-65 °C CPU en charge 7B continue, ventilateur quasi-inaudible. Peut tourner 24/7 sans stress sur la machine.
Mac mini M4 ou Raspberry Pi 5 pour un serveur LLM maison ?+
Pas comparable. Un Pi 5 16 Go fait tourner un 3B à ~4 tok/s max, sans GPU utile. Le Mac mini M4 est 10× plus rapide, 5× plus cher. Pour jouer, Pi 5. Pour un vrai serveur IA familial, Mac mini.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.