Débutant 11 minMac mini

Quel LLM sur Mac mini M4 / M4 Pro (16–64 Go) ?

Le Mac mini M4 (octobre 2024) est en 2026 le meilleur rapport performance/prix pour faire tourner un LLM en local. À 729 € en version 16 Go et 1599 € en M4 Pro 24 Go, il offre la même puce que le MacBook Pro M4 dans un boîtier de 12 × 12 × 5 cm, totalement silencieux en idle, 30 W max en charge. Un Mistral 7B y tourne à 36 tok/s, un Qwen 32B Q4 à 10 tok/s. Le guide complet.

Par Mohamed Meguedmi·Màj 2026-04-18·Testé sur macOS 14+

#Mac mini M4 / M4 Pro en 2026

Sortie
Octobre 2024. Configuration actuelle en 2026 (M5 attendu fin 2026).
Mac mini M4
10 cœurs CPU + 10 cœurs GPU, 120 Go/s, RAM 16, 24 ou 32 Go. Prix 729 à 1229 €.
Mac mini M4 Pro
12 ou 14 cœurs CPU + 16 ou 20 cœurs GPU, 273 Go/s, RAM 24, 48 ou 64 Go. Prix 1599 à 2629 €.
Format
12,7 × 12,7 × 5 cm — plus petit qu'un Mac mini classique. Ventilateur quasi-inaudible en idle.
Consommation
4 W idle, 20-25 W en 7B, 35 W max en pic sur 32B. ~10-15 €/an d'électricité en usage intensif.
Le best-value 2026 pour l'IA locale
Mac mini M4 Pro 48 Go à 2199 € : 273 Go/s de bande passante, fait tourner Qwen 32B Q5 à 17 tok/s, Llama 3.3 70B Q3 à 7 tok/s. Un PC équivalent en perf LLM (avec 48 Go de VRAM unifiée) est impossible à construire à ce prix.

#1. M4 vs M4 Pro : choisir

Mac mini M4 (120 Go/s)
Idéal pour 7B-14B. Le 16 Go à 729 € est la porte d'entrée la plus abordable chez Apple pour l'IA locale sérieuse.
Mac mini M4 Pro (273 Go/s)
Ouvre 24B-32B confortable, 48 Go RAM accessibles. Pour un serveur LLM maison ou équipe.
Écart prix (config 24 Go)
Mac mini M4 24 Go : 929 €. Mac mini M4 Pro 24 Go : 1599 €. +670 € pour 2,3× la bande passante.
Verdict
M4 base si usage perso 7B-14B. M4 Pro dès que vous visez 24B+ ou multi-utilisateurs.

#2. Modèles par RAM

Modèles recommandés Mac mini M4 / M4 Pro
ModèleQuantM4 16M4 24M4 32M4 Pro 24M4 Pro 48M4 Pro 64
Mistral 7BQ5_K_M✓ 33✓ 35✓ 36✓ 46✓ 48✓ 50
Phi-4 14BQ5_K_M✓ 14✓ 16✓ 17✓ 23✓ 25✓ 26
Qwen 2.5 14B CoderQ5_K_M✓ 13✓ 14✓ 16✓ 21✓ 23✓ 24
Mistral Small 24BQ5_K_M✓ 10✓ 11✓ 16✓ 17✓ 18
Qwen 2.5 32BQ4_K_M✓ 7✓ 10✓ 17✓ 18
Llama 3.3 70BQ3_K_M✓ 7
Llama 3.3 70BQ4_K_M
i
Pour le 70B
Le Mac mini M4 Pro 64 Go fait tourner Llama 3.3 70B Q3_K_M à ~7 tok/s. Mais la qualité Q3 est notablement en retrait — pour un vrai 70B (Q4+), il faut un Mac Studio.

#3. Benchmarks 2026

Mac mini M4 Pro 14-core, 48 Go, Ollama 0.5.x
ModèleQ4_K_MQ5_K_MMLX 4-bit
Mistral 7B50 t/s48 t/s54 t/s
Phi-4 14B27 t/s25 t/s29 t/s
Mistral Small 24B18 t/s17 t/s20 t/s
Qwen 2.5 32B17 t/s15 t/s18 t/s

#4. Installation + serveur LLM

Setup complet Mac mini M4 Pro serveur
# Ollama
brew install --cask ollama

# Écoute sur tout le LAN
launchctl setenv OLLAMA_HOST "0.0.0.0:11434"
launchctl setenv OLLAMA_ORIGINS "*"
launchctl setenv OLLAMA_FLASH_ATTENTION 1
launchctl setenv OLLAMA_KV_CACHE_TYPE q8_0

# Mémoire GPU élargie (Mac mini M4 Pro 48 Go)
sudo sysctl iogpu.wired_limit_mb=40960

# Démarrage auto
brew services start ollama

# Modèles polyvalents
ollama pull mistral
ollama pull qwen2.5:14b
ollama pull nomic-embed-text

#5. Cas d'usage typiques du Mac mini M4

Serveur LLM maison
Un Mac mini M4 Pro 48 Go couvre les besoins d'une famille ou petite équipe (5-10 utilisateurs). Posé près du routeur, exposé en LAN.
Terminal NAS + IA
Peut jouer NAS Synology-like (Time Machine, Plex, photos iCloud) + serveur LLM. Une seule machine pour tout.
Back-end d'apps dev
API OpenAI-compatible à localhost pour vos scripts, n8n, Continue.dev, Aider. Évite de payer des tokens OpenAI en dev.
RAG documentaire
24B + embeddings multilingues + reranker : tout en RAM sur Mac mini M4 Pro 48 Go. Pour un RAG sérieux (docs internes, legal, médical).

#Mac mini M4 vs MBA M4 vs MBP M4

Config 16 Go équivalente, tokens/sec Mistral 7B Q5
MachinePrix 20267B tok/sThrottleMobilité
Mac mini M4 16 Go729 €33-36 (soutenu)AucunNon
MacBook Air M4 16 Go1299 €32 (10 min) puis 26Oui -20 %Oui
MacBook Pro M4 16 Go1899 €34 (soutenu)AucunOui
Règle simple
Mac mini M4 si sédentaire → meilleur euro investi. MBA M4 si portabilité + silence comptent. MBP M4 si portabilité sans compromis.

#Questions fréquentes

Le Mac mini M4 à 729 € est-il vraiment viable pour l'IA locale ?+
Oui. 16 Go de mémoire unifiée, 120 Go/s de bande passante, Mistral 7B à 33 tok/s, Phi-4 14B à 14 tok/s. Pour un usage perso ou familial, c'est largement suffisant. C'est littéralement l'entrée de gamme Apple pour l'IA locale la plus accessible.
Mac mini M4 24 Go ou 32 Go ?+
24 Go à 929 € couvre la plupart des usages (14B en Q5 confortable). 32 Go à 1229 € n'ouvre pas de palier supplémentaire significatif — n'achetez les 32 Go que si vous avez un usage RAG très gourmand ou si vous voulez tourner deux modèles 14B en parallèle.
Mac mini M4 Pro 48 Go pour un 70B ?+
Uniquement en Q3 très compressé (~30 Go) à 7-8 tok/s avec qualité dégradée. Pour du 70B Q4 sérieux, il faut un Mac mini M4 Pro 64 Go (qui passe tout juste en Q3) ou plus probablement un Mac Studio.
Peut-on utiliser le Mac mini M4 en serveur tête coupée (sans écran) ?+
Oui, et c'est le cas d'usage typique. Configurez en SSH uniquement, désactivez la mise en veille auto, posez-le à côté du routeur. Accédez-y par Screen Sharing si besoin ponctuel d'UI.
Le Mac mini M4 chauffe-t-il ?+
Très peu. Design thermique calibré pour l'inférence soutenue : ~55-65 °C CPU en charge 7B continue, ventilateur quasi-inaudible. Peut tourner 24/7 sans stress sur la machine.
Mac mini M4 ou Raspberry Pi 5 pour un serveur LLM maison ?+
Pas comparable. Un Pi 5 16 Go fait tourner un 3B à ~4 tok/s max, sans GPU utile. Le Mac mini M4 est 10× plus rapide, 5× plus cher. Pour jouer, Pi 5. Pour un vrai serveur IA familial, Mac mini.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.