Le guide de référence · 16 chapitres · assets inclus · mises à jour à vie
Ton Mac, à fond
pour l'IA locale
Le kit Mac : LE guide de référence pour exploiter l'IA locale à fond sur Apple Silicon — mémoire unifiée, MLX face à GGUF, le bon modèle pour TA puce (M1 à M5/M6), et tout ce que macOS offre en plus. Pour un Mac qui vient d'être acheté comme pour un Mac de 2020 jamais poussé à fond.
Obtenir le kit — 24 €24 € · paiement unique · mises à jour à vie incluses
✓ Pour toi si…
tu as un Mac Apple Silicon (MacBook Air/Pro, Mac mini, Mac Studio, iMac — puce M1 à M5/M6) et tu veux comprendre et exploiter ce qui lui est propre pour l'IA locale : sa mémoire unifiée, MLX, le bon modèle pour ta puce précise, les vraies performances — que tu débutes ou que tu fasses déjà tourner Ollama/LM Studio sans être sûr d'en tirer le maximum.
✗ Pas pour toi si…
tu es sur PC ou Linux (c'est le kit IA Locale, multi-OS) ou tu cherches un copilote qui code dans ton éditeur (c'est le kit Copilote Local, avec un seul renvoi vers Xcode dans ce kit, jamais un chapitre dédié).
Pourquoi tu peux t'y fier
Ce guide est écrit et maintenu par l'équipe de QuelLLM.fr — 243 modèles indexés, 251 guides en français, mis à jour chaque matin — qui opère aussi des plateformes IA en production toute l'année (RegulIA, IAPRO). Chaque commande, modèle, version et prix de ce guide est vérifié contre la source officielle à la date d'édition (Apple, Ollama, LM Studio, Hugging Face) et revérifié à chaque édition, sur les profils de machines que nous utilisons nous-mêmes. Ce que tu lis est condensé, vérifié, sans détour. Pas une compilation de tutos trouvés au hasard. Qui est derrière QuelLLM →
Le problème
Un Mac Apple Silicon n'est pas juste un PC avec un logo pour l'IA locale : mémoire unifiée partagée avec le GPU, MLX face à GGUF, une limite mémoire par défaut qu'on peut relever si on sait comment — la plupart des guides traitent ton Mac comme n'importe quelle machine, et tu laisses la moitié de sa capacité sur la table.
L'information Mac est déjà là, éclatée sur 21 guides gratuits du site — un par machine, un pour MLX, un pour la mémoire unifiée. Le kit est LA méthode de référence : le tableau modèle par puce ET par palier de RAM assemblé en un seul endroit, les scripts launchd et Raccourcis prêts à coller, la méthode pour mesurer tes propres performances — pas une compilation de tutos à recouper toi-même.
MLX natif vs GGUF sur ton Mac
Le même modèle, deux formats — le choix le plus mal expliqué dans les guides gratuits existants. Le comparatif honnête :
| MLX (Apple) | GGUF (llama.cpp/Ollama) | |
|---|---|---|
| Pensé pour la mémoire unifiée dès sa conception | Oui | Compatible, pas natif |
| Disponibilité des modèles | Une bonne partie, pas tout | La quasi-totalité |
| Compatibilité multi-OS (PC, Linux) | Non — Apple Silicon uniquement | Oui |
| Bascule dans LM Studio | Un réglage GUI | Un réglage GUI |
Ligne de commande (mlx-lm) | Optionnel, pour aller plus loin | Ollama CLI natif |
Le kit te dit dans quels cas MLX apporte un vrai gain, et dans quels cas GGUF reste le bon choix (modèle absent en MLX, besoin de compatibilité multi-OS) — jamais un dogme, une méthode.
Ce que tu obtiens
- Ton espace en ligne, à vie — les 16 chapitres lisibles en web, toujours la dernière édition.
- Le guide complet en PDF — le même contenu, à toi pour toujours, hors-ligne.
- 21 fichiers d'assets prêts à l'emploi — le tableau maître Go→modèle par puce (
.md+.csv), le cheat-sheet mémoire unifiée (commandessysctl+ LaunchDaemon), l'arbre de décision MLX/GGUF, le.plistlaunchd pour Ollama en service, le compose Open WebUI adapté Mac, l'export Raccourcis, et plus. - 3 profils d'ancrage — MacBook Air M2 16 Go (ta machine actuelle si tu en as un — plus vendue neuve, cf. Ch.15), Mac mini M4 24 Go, Mac Studio M4 Max 64 Go : tu retrouves ta configuration à chaque chapitre, jamais un exemple qui ne te concerne pas.
- Le chapitre « quand ça casse sur Mac » — un arbre de décision par symptôme (Metal pas détecté, système inutilisable pendant une génération, modèle qui refuse de charger, throttling).
- Édition vivante — chaque mise à jour (nouvelles puces Apple, nouveaux modèles, MLX qui évolue) apparaît dans ton espace, à vie, sans rien repayer.
Outils : LM Studio (MLX), Ollama, Open WebUI, mlx-lm. Mac Apple Silicon exclusivement, 0 €/mois une fois installé.
Les 16 chapitres du kit
Du premier LLM 100 % Metal en moins d'une heure à la grille d'achat 2026. Rien à sauter : chaque chapitre renvoie vers les suivants.
- Ton premier LLM 100 % Metal, en une heure
- Mémoire unifiée : ce que ça change vraiment (et comment forcer la limite GPU)
- MLX ou GGUF : lequel choisir, et quand ça compte
- Le tableau de référence : quel modèle pour QUELLE puce, quelle RAM
- Quantification et contexte long : calculer ton vrai budget mémoire
- Performances réelles : tokens/seconde, préfill, chaleur, batterie
- Ollama comme service : lancement automatique, réseau, logs (launchd)
- Open WebUI sur Mac : Docker Desktop, OrbStack ou natif
- La vision en local, nativement accélérée par Metal
- Modèles français et anglais : ce qui tourne vraiment bien sur Apple Silicon
- Raccourcis, Automator, Spotlight : l'IA locale dans macOS
- Ton Mac mini en serveur IA pour toute la maison
- Confidentialité : iCloud, Spotlight, télémétrie — ce qui reste vraiment local
- Quand ça casse sur Mac : Metal, mémoire, swap
- Quel Mac acheter pour l'IA locale en 2026
- Cette édition est datée — et après ?
Édition vivante : chaque mise à jour enrichit ce sommaire (Update Log daté, ch.16) — tu ne rachètes rien à la prochaine version.
Ton premier LLM 100 % Metal en une heure, pas à pas
Que tu partes de zéro ou que tu aies déjà un outil installé, le guide te tient la main jusqu'à un résultat concret :
1 · LM Studio ou Ollama
2 commandes si tu pars de zéro (renvoi complet au kit IA Locale), sinon on passe direct à la suite.
2 · Vérifie que Metal tourne
Le Moniteur d'activité (onglet GPU) doit montrer le GPU au travail — pas un fallback CPU silencieux.
3 · Le bon modèle pour ta puce
Le tableau du Chapitre 4 te dit lequel selon ta puce et ta mémoire unifiée — pas besoin de deviner.
4 · Va plus loin
Mémoire unifiée, MLX, launchd, Raccourcis — tout est dans les chapitres suivants.
- L'espace en ligne à vie : 16 chapitres toujours à jour (sommaire complet plus haut)
- Le guide PDF + les 21 fichiers d'assets (tableau maître, scripts launchd/Raccourcis, checklists) à télécharger
- Les 3 profils d'ancrage (Air, mini, Studio) et l'arbre de dépannage Metal/mémoire/swap
- Toutes les éditions futures, à vie — elles apparaissent dans ton espace
- Accès immédiat après paiement, clé d'accès envoyée par email
Paiement sécurisé par Stripe. Facture PDF envoyée automatiquement · TVA non applicable, art. 293 B du CGI.
La vérité honnête
Un Mac Apple Silicon a de vrais atouts pour l'IA locale — et de vraies limites qu'aucun tableau de puces ne résout. Un guide de référence te doit cette carte honnête :
À la fin, tu sais faire
- Expliquer la mémoire unifiée et relever, si besoin, la limite allouée au GPU (
iogpu.wired_limit_mb). - Choisir entre MLX et GGUF selon le modèle, sans jargon inutile, et lancer les deux si besoin.
- Trouver le bon modèle pour TA puce et TA mémoire unifiée en une lecture du tableau maître.
- Faire tourner Ollama comme un vrai service macOS (launchd) et transformer un Mac mini en serveur familial.
- Vérifier toi-même que rien ne sort de ton Mac (iCloud Drive, Spotlight) — pas juste nous croire sur parole.
- Diagnostiquer et réparer seul les pannes spécifiques Mac (Metal, mémoire, swap).
Édition vivante — comme tous les kits QuelLLM
« Mises à jour à vie » n'est pas un slogan : le matériel Apple change deux fois par an, MLX évolue vite — le kit suit l'écosystème pour toi, sans rien te faire repayer.
v2026.09 (édition actuelle) — première édition du kit : 16 chapitres, 3 profils d'ancrage (MacBook Air M2 16 Go, Mac mini M4 24 Go, Mac Studio M4 Max 64 Go), 21 fichiers d'assets, tableau maître Go→modèle par puce.
Les prochaines éditions (nouvelles puces Apple, nouveaux modèles, MLX qui évolue) s'ajoutent ici, datées, et t'arrivent dans ton espace sans rien repayer.
Questions fréquentes
Quelle est la différence avec le kit IA Locale ?
Le kit IA Locale t'installe un assistant IA privé sur Mac OU sur PC, pour un public grand public multi-OS — il reste volontairement général. Ce kit part du principe qu'un Mac est déjà en jeu et va au fond de tout ce qui est spécifique à Apple Silicon : la mémoire unifiée et sa limite GPU, MLX face à GGUF, le tableau modèle par puce ET par palier de RAM (M1 à M5/M6, 8 à 512 Go), la méthode pour mesurer tes propres performances réelles, et ce que macOS offre en plus (Raccourcis, launchd, Spotlight, Apple Intelligence). Les deux se complètent, ils ne se recouvrent pas.
Ça ne marche que sur Mac Apple Silicon ?
Oui, exclusivement — un Mac avec puce M1 à M5/M6 (MacBook Air, MacBook Pro, Mac mini, Mac Studio, iMac). Un Mac Intel n'a pas de mémoire unifiée ni MLX, la majorité du kit ne s'applique pas. Si tu es sur PC (ou si tu ne sais pas encore quel Mac acheter), commence par le kit IA Locale ou le Ch.15 de ce kit (grille de décision d'achat, sans lien marchand).
Il faut être développeur pour suivre ce kit ?
Non. Le kit part du principe que tu sais installer une app et glisser un fichier — les commandes Terminal (mémoire unifiée au Ch.2, launchd au Ch.7) sont expliquées la première fois qu'elles apparaissent, jamais supposées acquises. Certaines sections vont plus loin que le grand public (mlx-lm en ligne de commande) — toujours présentées comme « pour aller plus loin », jamais un prérequis pour suivre la suite.
Combien de temps pour avoir un résultat ?
Ton premier LLM avec l'accélération Metal active, en moins d'une heure — que tu partes de zéro (2 commandes, renvoi au kit IA Locale pour l'installation complète) ou que tu aies déjà LM Studio/Ollama et veuilles juste vérifier que Metal tourne vraiment, pas un fallback CPU silencieux.
Quelle est la différence avec les guides Mac gratuits du site ?
Les guides gratuits de QuelLLM.fr couvrent chaque machine ou chaque sujet séparément (un guide par Mac, MLX vs llama.cpp d'un côté, optimisation mémoire de l'autre). Le kit assemble le parcours complet, livre le tableau modèle par puce × RAM qu'aucun guide isolé ne fournit à jour et complet, les scripts launchd/Raccourcis prêts à coller, et reste à jour à vie face à un matériel Apple qui change deux fois par an — c'est l'assemblage et les assets qui se paient, pas l'information brute.
Est-ce vraiment gratuit une fois installé ?
Oui : le modèle tourne sur ta machine, 0 €/mois, pas de compte, pas de limite. Le kit lui-même (guide + assets + espace en ligne à vie) est un achat unique.
Est-ce que je peux vraiment monter un serveur IA avec mon Mac mini ?
Oui, le Chapitre 12 couvre exactement ça : empêcher la mise en veille, faire tourner Ollama comme un vrai service (launchd, Ch.7) qui survit au redémarrage, et y accéder depuis les autres appareils du foyer — avec une mention honnête des options d'accès à distance (VPN personnel type Tailscale), sans faire passer ça pour une checklist de sécurité entreprise.
Mes conversations et mes modèles restent privés sur mon Mac ?
C'est le principe du local — rien ne part une fois le modèle chargé. Le Chapitre 13 va plus loin que la checklist générique : il vérifie spécifiquement qu'iCloud Drive ne synchronise pas silencieusement ton dossier de modèles ou de conversations, et ce que Spotlight indexe autour de ces dossiers.
Et si ça ne me convient pas après achat ?
Satisfait ou remboursé pendant 30 jours, un email suffit, sans justification — comme sur tous les kits QuelLLM.
C'est livré comment, et pour combien de temps ?
Accès immédiat après paiement : ton espace en ligne à vie (toujours la dernière édition) + le PDF et le zip des assets à télécharger, à toi pour toujours. Les mises à jour futures (nouvelles puces Apple, nouveaux modèles) apparaissent dans ton espace sans rien repayer.
Puis-je avoir une facture ?
Oui, automatiquement. Dès le paiement (Stripe), tu reçois par email ton reçu Stripe et ta facture PDF au nom de Falcon Consulting (éditeur de QuelLLM), à tes coordonnées — indique ton entreprise ou ton SIREN dans le champ prévu au moment du paiement. TVA non applicable, art. 293 B du CGI.
Et si je veux plusieurs kits QuelLLM ?
Le bundle « tous les kits, à vie » regroupe tous les kits actuels et futurs pour 49 €. Si tu as déjà acheté un kit à 24 €, l'upgrade vers le bundle te coûte 25 €, pas 49 € — le coupon s'applique automatiquement.
Exploite ton Mac à fond.
Le guide de référence, de ton premier LLM en accélération Metal au serveur IA familial sur ton Mac mini — mémoire unifiée, MLX, le bon modèle pour ta puce. Aujourd'hui, pas « un jour ».
Obtenir le kit — 24 €