Débutant 10 minMac mini

Quel LLM sur Mac mini M2 / M2 Pro (8–32 Go) ?

Sorti début 2023, le Mac mini M2 / M2 Pro reste en 2026 un excellent choix pour un serveur LLM à domicile. Pour 600 à 1500 € d'occasion, on obtient une machine silencieuse, peu énergivore (10-30 W en inférence), et capable de faire tourner des modèles 14B à 20B en Q5 sans broncher. Ce guide détaille comment en faire un serveur d'inférence 24/7 pour toute la maison.

Par Mohamed Meguedmi·Màj 2026-04-18·Testé sur macOS 14+

#Mac mini M2 / M2 Pro en 2026

Sortie
Janvier 2023. Remplacé par le Mac mini M4 fin 2024, mais très présent d'occasion.
Mac mini M2
8 cœurs CPU + 10 cœurs GPU, 100 Go/s, RAM 8/16/24 Go. Prix neuf barré à 699 €, occasion ~450 €.
Mac mini M2 Pro
10 ou 12 cœurs CPU + 16 ou 19 cœurs GPU, 200 Go/s, RAM 16 ou 32 Go. Occasion ~900-1200 €.
Refroidissement
Ventilateur actif — aucun throttle, tourne 24/7 sans problème.
Consommation
5 W au repos, 15-25 W en inférence 7B, 30 W max en pic sur 24B. Soit ~15 €/an d'électricité en usage intensif.
Pourquoi c'est une affaire serveur
Un Mac mini M2 Pro 32 Go d'occasion à 1100 € fait tourner Mistral Small 24B en Q5 à 18 tok/s, silencieusement et avec 25 W de consommation. Comparez à un PC équivalent : RTX 3060 Ti + CPU + alim = 800 W max, bruit de ventilo, 3× la conso électrique annuelle.

#1. M2 vs M2 Pro : choisir

Mac mini M2 (100 Go/s)
Parfait pour 7B-8B à 25-30 tok/s. Suffisant pour chat familial, extension Ollama dans un réseau, API OpenAI-compat locale.
Mac mini M2 Pro (200 Go/s)
Double bande passante + option 32 Go RAM. Ouvre 24B confortable. Pour un serveur multi-utilisateurs ou RAG sérieux.
Prix d'occasion
Mac mini M2 16 Go : 500-600 €. Mac mini M2 Pro 32 Go : 1100-1300 €. Écart important mais justifié pour du 14B+.

#2. Modèles par config RAM

Modèles recommandés Mac mini M2 / M2 Pro
ModèleQuantM2 8 GoM2 16 GoM2 24 GoM2 Pro 16M2 Pro 32
Qwen 2.5 3BQ5_K_M✓ 45✓ 48✓ 48✓ 50✓ 52
Mistral 7BQ5_K_M✓ 22✓ 26✓ 26✓ 38✓ 40
Llama 3.1 8BQ5_K_M✓ 22✓ 24✓ 32✓ 34
Phi-4 14BQ5_K_M✓ 13✓ 17✓ 19
Qwen 2.5 14BQ5_K_M✓ 11✓ 15✓ 17
Mistral Small 24BQ5_K_M✓ 12
Qwen 2.5 32BQ4_K_M✓ 8

#3. Benchmarks

Mac mini M2 Pro 12-core, 32 Go, Ollama, secteur
ModèleQ4_K_MQ5_K_MQ8_0
Mistral 7B42 t/s40 t/s26 t/s
Phi-4 14B22 t/s19 t/s11 t/s
Mistral Small 24B14 t/s12 t/s
Qwen 2.5 32B9 t/s8 t/s

#4. Installation + serveur 24/7

Setup serveur Ollama
# Installation
brew install --cask ollama

# Configuration pour écouter sur le réseau local
launchctl setenv OLLAMA_HOST "0.0.0.0:11434"
launchctl setenv OLLAMA_ORIGINS "*"

# Démarrage auto au boot
brew services start ollama

# Auto-login + pas de mise en veille (pour un serveur)
# Réglages → Écran de verrouillage → Éteindre après : Jamais
# Réglages → Économie d'énergie → Empêcher la mise en veille auto

# Modèle pour l'API
ollama pull mistral
ollama pull nomic-embed-text  # pour RAG
!
Exposer Ollama : sécurité
OLLAMA_HOST=0.0.0.0 expose l'API sur tout le LAN — suffit pour un réseau domestique de confiance. Pour exposer au-delà (VPN, internet), obligatoire : mettre un reverse proxy avec auth (Caddy, nginx + basic auth) devant.

#5. Mac mini comme serveur LLM

C'est l'usage le plus pertinent du Mac mini : posé à côté du routeur, il fournit un endpoint OpenAI-compatible pour toute la maison. Ollama écoute sur :11434, n'importe quel client (Enchanted, Open WebUI, Raycast AI, Zed) s'y connecte.

Bureau → Chat
Enchanted iOS / macOS, LibreChat, Open WebUI via Docker. Pointez http://mac-mini.local:11434.
Terminal / Code
Continue.dev, Aider, Zed. Configurez l'URL du serveur Ollama dans les settings.
Automatisation
n8n, Shortcuts iOS, Home Assistant. Tous parlent OpenAI API — Ollama est drop-in compatible.
Monitoring
Ajoutez un dashboard Grafana + Prometheus ollama-exporter pour suivre tokens/sec, latence, modèles chargés.
Test depuis un autre poste
# Depuis votre laptop, testez l'API
curl http://mac-mini.local:11434/api/chat \
  -d '{"model":"mistral","messages":[{"role":"user","content":"Bonjour"}]}'

#Mac mini M2 vs M4

Vitesse 7B
M2 : 26 tok/s. M4 : 36 tok/s (+40 %).
Vitesse 24B
M2 Pro : 12 tok/s. M4 Pro : 19 tok/s (+60 %).
Prix neuf 2026
M2 : plus vendu neuf. M4 : 729 €. M4 Pro : 1599 €.
Prix occasion
M2 16 Go : 500 €. M2 Pro 32 Go : 1200 €. Verdict : si budget serré, M2 occasion reste un deal. Sinon M4 neuf.

#Questions fréquentes

Le Mac mini M2 peut-il tourner 24/7 en serveur LLM ?+
Oui, sans souci. Ventilateur conçu pour ça, conso 10-30 W en usage, Apple garantit le matériel. Beaucoup d'utilisateurs le font tourner des années sans problème.
Quel Mac mini M2 choisir d'occasion en 2026 ?+
Mac mini M2 Pro 32 Go si vous trouvez à 1100-1200 € — imbattable. Sinon Mac mini M2 16 Go à 500-600 € est un très bon point d'entrée. Évitez le Mac mini M2 8 Go (trop juste pour LLM).
Puis-je accéder au Mac mini LLM depuis mon iPhone ?+
Oui. Installez Enchanted (gratuit, App Store), pointez http://mac-mini.local:11434 dans les réglages. Chat avec vos modèles depuis iOS, 100 % local.
Le Mac mini M2 est-il plus rapide qu'un MacBook Air M2 ?+
Légèrement (~5 %) sur les 7B : ventilateur actif évite le throttle. Sur les 14B+ en soutenu, l'écart grimpe à 15-20 % car le mini ne throttle jamais.
Combien consomme le Mac mini M2 en serveur LLM 24/7 ?+
En idle 90 % du temps + inférence 10 % du temps : moyenne ~8 W. Soit ~0,19 kWh/jour, ~70 kWh/an = 15-20 €/an d'électricité (tarif FR 2025). Moins qu'une ampoule LED.
Peut-on utiliser le Mac mini M2 Pro 32 Go pour du fine-tuning ?+
LoRA sur 7B via MLX : oui, lentement (plusieurs heures). Full fine-tuning : non praticable. Utilisez le mini pour l'inférence, le fine-tuning se fait mieux en cloud ponctuellement.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.