Débutant 11 minMac mini

Quel LLM sur Mac mini M4 / M4 Pro (16–64 Go) ?

Le Mac mini M4 (octobre 2024) est en 2026 le meilleur rapport performance/prix pour faire tourner un LLM en local. À 729 € en version 16 Go et 1599 € en M4 Pro 24 Go, il offre la même puce que le MacBook Pro M4 dans un boîtier de 12 × 12 × 5 cm, totalement silencieux en idle, 30 W max en charge. Un Qwen 3.5 9B y tourne à ~30 tok/s sur le M4 de base, un Qwen 3.6 35B-A3B (MoE) à ~40 tok/s sur M4 Pro. Le guide complet.

Par Mohamed Meguedmi·Màj 2026-08-27·Testé sur macOS 14+

#Mac mini M4 / M4 Pro en 2026

Sortie
Octobre 2024. Configuration actuelle en 2026 (M5 attendu fin 2026).
Mac mini M4
10 cœurs CPU + 10 cœurs GPU, 120 Go/s, RAM 16, 24 ou 32 Go. Prix 729 à 1229 €.
Mac mini M4 Pro
12 ou 14 cœurs CPU + 16 ou 20 cœurs GPU, 273 Go/s, RAM 24, 48 ou 64 Go. Prix 1599 à 2629 €.
Format
12,7 × 12,7 × 5 cm — plus petit qu'un Mac mini classique. Ventilateur quasi-inaudible en idle.
Consommation
4 W idle, 20-25 W en 7B, 35 W max en pic sur 32B. ~10-15 €/an d'électricité en usage intensif.
Le best-value 2026 pour l'IA locale
Mac mini M4 Pro 48 Go à 2199 € : 273 Go/s de bande passante, fait tourner Qwen 3.8 27B à ~15 tok/s et un MoE Qwen 3.6 35B-A3B à ~40 tok/s (3B actifs, donc rapide malgré la taille). Un PC équivalent en perf LLM (avec 48 Go de VRAM unifiée) est impossible à construire à ce prix.

#1. M4 vs M4 Pro : choisir

Mac mini M4 (120 Go/s)
Idéal pour 7B-14B. Le 16 Go à 729 € est la porte d'entrée la plus abordable chez Apple pour l'IA locale sérieuse.
Mac mini M4 Pro (273 Go/s)
Ouvre 24B-32B confortable, 48 Go RAM accessibles. Pour un serveur LLM maison ou équipe.
Écart prix (config 24 Go)
Mac mini M4 24 Go : 929 €. Mac mini M4 Pro 24 Go : 1599 €. +670 € pour 2,3× la bande passante.
Verdict
M4 base si usage perso 7B-14B. M4 Pro dès que vous visez 24B+ ou multi-utilisateurs.

#2. Modèles par RAM

Modèles recommandés Mac mini M4 / M4 Pro
ModèleQuantM4 16M4 24M4 32M4 Pro 24M4 Pro 48M4 Pro 64
Qwen 3.5 9BQ5_K_M✓ 30✓ 32✓ 33✓ 42✓ 44✓ 46
Gemma 4 12BQ5_K_M✓ 14✓ 16✓ 17✓ 23✓ 25✓ 26
Mistral Small 24BQ4_K_M✓ 10✓ 11✓ 16✓ 17✓ 18
Devstral 24B (code)Q4_K_M✓ 10✓ 11✓ 16✓ 17✓ 18
Qwen 3.8 27BQ4_K_M✓ 8✓ 12✓ 15✓ 16
Qwen 3.6 35B-A3B (MoE)Q4_K_M✓ 28✓ 34✓ 40✓ 42
Qwen3-Coder 30B-A3BQ8_0✓ 30✓ 32
i
Pour les gros modèles
En 2026, les modèles denses 70B ont laissé la place aux MoE ~30B-A3B (3 milliards de paramètres actifs) : sur Mac mini M4 Pro 48 ou 64 Go, un Qwen 3.6 35B-A3B ou un Qwen3-Coder 30B-A3B tourne en pleine qualité Q8 (~32 Go) à 30-42 tok/s — nettement plus rapide qu'un ancien 70B dense compressé, et sans perte de qualité. Pour aller au-delà (RAM > 96 Go, gros MoE 100B+), il faut un Mac Studio.

#3. Benchmarks 2026

Mac mini M4 Pro 14-core, 48 Go, Ollama 0.5.x
ModèleQ4_K_MQ5_K_MMLX 4-bit
Qwen 3.5 9B46 t/s44 t/s50 t/s
Gemma 4 12B27 t/s25 t/s29 t/s
Mistral Small 24B18 t/s17 t/s20 t/s
Qwen 3.6 35B-A3B (MoE)42 t/s40 t/s45 t/s

#4. Installation + serveur LLM

Setup complet Mac mini M4 Pro serveur
# Ollama
brew install --cask ollama

# Écoute sur tout le LAN
launchctl setenv OLLAMA_HOST "0.0.0.0:11434"
launchctl setenv OLLAMA_ORIGINS "*"
launchctl setenv OLLAMA_FLASH_ATTENTION 1
launchctl setenv OLLAMA_KV_CACHE_TYPE q8_0

# Mémoire GPU élargie (Mac mini M4 Pro 48 Go)
sudo sysctl iogpu.wired_limit_mb=40960

# Démarrage auto
brew services start ollama

# Modèles polyvalents 2026
ollama pull qwen3.5:9b
ollama pull gemma4:12b
ollama pull nomic-embed-text

#5. Cas d'usage typiques du Mac mini M4

Serveur LLM maison
Un Mac mini M4 Pro 48 Go couvre les besoins d'une famille ou petite équipe (5-10 utilisateurs). Posé près du routeur, exposé en LAN.
Terminal NAS + IA
Peut jouer NAS Synology-like (Time Machine, Plex, photos iCloud) + serveur LLM. Une seule machine pour tout.
Back-end d'apps dev
API OpenAI-compatible à localhost pour vos scripts, n8n, Cline, Aider. Évite de payer des tokens OpenAI en dev.
RAG documentaire
24B + embeddings multilingues + reranker : tout en RAM sur Mac mini M4 Pro 48 Go. Pour un RAG sérieux (docs internes, legal, médical).

#Mac mini M4 vs MBA M4 vs MBP M4

Config 16 Go équivalente, tokens/sec Qwen 3.5 9B Q5
MachinePrix 20269B tok/sThrottleMobilité
Mac mini M4 16 Go729 €30-33 (soutenu)AucunNon
MacBook Air M4 16 Go1299 €29 (10 min) puis 23Oui -20 %Oui
MacBook Pro M4 16 Go1899 €31 (soutenu)AucunOui
Règle simple
Mac mini M4 si sédentaire → meilleur euro investi. MBA M4 si portabilité + silence comptent. MBP M4 si portabilité sans compromis.

#Questions fréquentes

Le Mac mini M4 à 729 € est-il vraiment viable pour l'IA locale ?+
Oui. 16 Go de mémoire unifiée, 120 Go/s de bande passante, Qwen 3.5 9B à ~30 tok/s, Gemma 4 12B à ~14 tok/s. Pour un usage perso ou familial, c'est largement suffisant. C'est littéralement l'entrée de gamme Apple pour l'IA locale la plus accessible.
Mac mini M4 24 Go ou 32 Go ?+
24 Go à 929 € couvre la plupart des usages (14B en Q5 confortable). 32 Go à 1229 € n'ouvre pas de palier supplémentaire significatif — n'achetez les 32 Go que si vous avez un usage RAG très gourmand ou si vous voulez tourner deux modèles 14B en parallèle.
Mac mini M4 Pro 48 Go pour un gros modèle ?+
En 2026, plus besoin de viser un 70B dense : un MoE Qwen 3.6 35B-A3B ou un Qwen3-Coder 30B-A3B en pleine qualité Q8 (~32 Go) tient dans 48 Go et tourne à 30-42 tok/s (3B actifs). C'est plus rapide et plus fin qu'un ancien 70B compressé. Pour aller au-delà (gros MoE 100B+), il faut un Mac Studio.
Peut-on utiliser le Mac mini M4 en serveur tête coupée (sans écran) ?+
Oui, et c'est le cas d'usage typique. Configurez en SSH uniquement, désactivez la mise en veille auto, posez-le à côté du routeur. Accédez-y par Screen Sharing si besoin ponctuel d'UI.
Le Mac mini M4 chauffe-t-il ?+
Très peu. Design thermique calibré pour l'inférence soutenue : ~55-65 °C CPU en charge 7B continue, ventilateur quasi-inaudible. Peut tourner 24/7 sans stress sur la machine.
Mac mini M4 ou Raspberry Pi 5 pour un serveur LLM maison ?+
Pas comparable. Un Pi 5 16 Go fait tourner un 3B à ~4 tok/s max, sans GPU utile. Le Mac mini M4 est 10× plus rapide, 5× plus cher. Pour jouer, Pi 5. Pour un vrai serveur IA familial, Mac mini.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.