Débutant 11 minMac mini
Quel LLM sur Mac mini M4 / M4 Pro (16–64 Go) ?
Le Mac mini M4 (octobre 2024) est en 2026 le meilleur rapport performance/prix pour faire tourner un LLM en local. À 729 € en version 16 Go et 1599 € en M4 Pro 24 Go, il offre la même puce que le MacBook Pro M4 dans un boîtier de 12 × 12 × 5 cm, totalement silencieux en idle, 30 W max en charge. Un Mistral 7B y tourne à 36 tok/s, un Qwen 32B Q4 à 10 tok/s. Le guide complet.
#Mac mini M4 / M4 Pro en 2026
- Sortie
- Octobre 2024. Configuration actuelle en 2026 (M5 attendu fin 2026).
- Mac mini M4
- 10 cœurs CPU + 10 cœurs GPU, 120 Go/s, RAM 16, 24 ou 32 Go. Prix 729 à 1229 €.
- Mac mini M4 Pro
- 12 ou 14 cœurs CPU + 16 ou 20 cœurs GPU, 273 Go/s, RAM 24, 48 ou 64 Go. Prix 1599 à 2629 €.
- Format
- 12,7 × 12,7 × 5 cm — plus petit qu'un Mac mini classique. Ventilateur quasi-inaudible en idle.
- Consommation
- 4 W idle, 20-25 W en 7B, 35 W max en pic sur 32B. ~10-15 €/an d'électricité en usage intensif.
→
Le best-value 2026 pour l'IA locale
Mac mini M4 Pro 48 Go à 2199 € : 273 Go/s de bande passante, fait tourner Qwen 32B Q5 à 17 tok/s, Llama 3.3 70B Q3 à 7 tok/s. Un PC équivalent en perf LLM (avec 48 Go de VRAM unifiée) est impossible à construire à ce prix.
#1. M4 vs M4 Pro : choisir
- Mac mini M4 (120 Go/s)
- Idéal pour 7B-14B. Le 16 Go à 729 € est la porte d'entrée la plus abordable chez Apple pour l'IA locale sérieuse.
- Mac mini M4 Pro (273 Go/s)
- Ouvre 24B-32B confortable, 48 Go RAM accessibles. Pour un serveur LLM maison ou équipe.
- Écart prix (config 24 Go)
- Mac mini M4 24 Go : 929 €. Mac mini M4 Pro 24 Go : 1599 €. +670 € pour 2,3× la bande passante.
- Verdict
- M4 base si usage perso 7B-14B. M4 Pro dès que vous visez 24B+ ou multi-utilisateurs.
#2. Modèles par RAM
Modèles recommandés Mac mini M4 / M4 Pro
| Modèle | Quant | M4 16 | M4 24 | M4 32 | M4 Pro 24 | M4 Pro 48 | M4 Pro 64 |
|---|---|---|---|---|---|---|---|
| Mistral 7B | Q5_K_M | ✓ 33 | ✓ 35 | ✓ 36 | ✓ 46 | ✓ 48 | ✓ 50 |
| Phi-4 14B | Q5_K_M | ✓ 14 | ✓ 16 | ✓ 17 | ✓ 23 | ✓ 25 | ✓ 26 |
| Qwen 2.5 14B Coder | Q5_K_M | ✓ 13 | ✓ 14 | ✓ 16 | ✓ 21 | ✓ 23 | ✓ 24 |
| Mistral Small 24B | Q5_K_M | — | ✓ 10 | ✓ 11 | ✓ 16 | ✓ 17 | ✓ 18 |
| Qwen 2.5 32B | Q4_K_M | — | — | ✓ 7 | ✓ 10 | ✓ 17 | ✓ 18 |
| Llama 3.3 70B | Q3_K_M | — | — | — | — | — | ✓ 7 |
| Llama 3.3 70B | Q4_K_M | — | — | — | — | — | — |
i
Pour le 70B
Le Mac mini M4 Pro 64 Go fait tourner Llama 3.3 70B Q3_K_M à ~7 tok/s. Mais la qualité Q3 est notablement en retrait — pour un vrai 70B (Q4+), il faut un Mac Studio.
#3. Benchmarks 2026
Mac mini M4 Pro 14-core, 48 Go, Ollama 0.5.x
| Modèle | Q4_K_M | Q5_K_M | MLX 4-bit |
|---|---|---|---|
| Mistral 7B | 50 t/s | 48 t/s | 54 t/s |
| Phi-4 14B | 27 t/s | 25 t/s | 29 t/s |
| Mistral Small 24B | 18 t/s | 17 t/s | 20 t/s |
| Qwen 2.5 32B | 17 t/s | 15 t/s | 18 t/s |
#4. Installation + serveur LLM
#5. Cas d'usage typiques du Mac mini M4
- Serveur LLM maison
- Un Mac mini M4 Pro 48 Go couvre les besoins d'une famille ou petite équipe (5-10 utilisateurs). Posé près du routeur, exposé en LAN.
- Terminal NAS + IA
- Peut jouer NAS Synology-like (Time Machine, Plex, photos iCloud) + serveur LLM. Une seule machine pour tout.
- Back-end d'apps dev
- API OpenAI-compatible à localhost pour vos scripts, n8n, Continue.dev, Aider. Évite de payer des tokens OpenAI en dev.
- RAG documentaire
- 24B + embeddings multilingues + reranker : tout en RAM sur Mac mini M4 Pro 48 Go. Pour un RAG sérieux (docs internes, legal, médical).
#Mac mini M4 vs MBA M4 vs MBP M4
Config 16 Go équivalente, tokens/sec Mistral 7B Q5
| Machine | Prix 2026 | 7B tok/s | Throttle | Mobilité |
|---|---|---|---|---|
| Mac mini M4 16 Go | 729 € | 33-36 (soutenu) | Aucun | Non |
| MacBook Air M4 16 Go | 1299 € | 32 (10 min) puis 26 | Oui -20 % | Oui |
| MacBook Pro M4 16 Go | 1899 € | 34 (soutenu) | Aucun | Oui |
→
Règle simple
Mac mini M4 si sédentaire → meilleur euro investi. MBA M4 si portabilité + silence comptent. MBP M4 si portabilité sans compromis.
#Questions fréquentes
Le Mac mini M4 à 729 € est-il vraiment viable pour l'IA locale ?+
Oui. 16 Go de mémoire unifiée, 120 Go/s de bande passante, Mistral 7B à 33 tok/s, Phi-4 14B à 14 tok/s. Pour un usage perso ou familial, c'est largement suffisant. C'est littéralement l'entrée de gamme Apple pour l'IA locale la plus accessible.
Mac mini M4 24 Go ou 32 Go ?+
24 Go à 929 € couvre la plupart des usages (14B en Q5 confortable). 32 Go à 1229 € n'ouvre pas de palier supplémentaire significatif — n'achetez les 32 Go que si vous avez un usage RAG très gourmand ou si vous voulez tourner deux modèles 14B en parallèle.
Mac mini M4 Pro 48 Go pour un 70B ?+
Uniquement en Q3 très compressé (~30 Go) à 7-8 tok/s avec qualité dégradée. Pour du 70B Q4 sérieux, il faut un Mac mini M4 Pro 64 Go (qui passe tout juste en Q3) ou plus probablement un Mac Studio.
Peut-on utiliser le Mac mini M4 en serveur tête coupée (sans écran) ?+
Oui, et c'est le cas d'usage typique. Configurez en SSH uniquement, désactivez la mise en veille auto, posez-le à côté du routeur. Accédez-y par Screen Sharing si besoin ponctuel d'UI.
Le Mac mini M4 chauffe-t-il ?+
Très peu. Design thermique calibré pour l'inférence soutenue : ~55-65 °C CPU en charge 7B continue, ventilateur quasi-inaudible. Peut tourner 24/7 sans stress sur la machine.
Mac mini M4 ou Raspberry Pi 5 pour un serveur LLM maison ?+
Pas comparable. Un Pi 5 16 Go fait tourner un 3B à ~4 tok/s max, sans GPU utile. Le Mac mini M4 est 10× plus rapide, 5× plus cher. Pour jouer, Pi 5. Pour un vrai serveur IA familial, Mac mini.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.