Stable Diffusion en local : installation et modèles
Stable Diffusion est un modèle de génération d'images à poids ouverts, publié en août 2022 par Stability AI avec des laboratoires universitaires. Il transforme un texte en image sur votre propre ordinateur, gratuitement, sans compte et sans limite de volume. Au 20 septembre 2026, c'est toujours la famille de modèles d'image la plus installée en local, avec l'écosystème le plus riche. Ce guide vous aide à choisir une version, une interface, et à produire votre première image sur Windows, Mac ou Linux.
#Stable Diffusion, c'est quoi ?
Stable Diffusion est un modèle de diffusion latente. Il part d'une image de bruit pur et la débruite pas à pas, guidé par votre texte, jusqu'à faire apparaître une image cohérente. Le calcul se fait dans un espace compressé, dit latent, ce qui explique qu'une carte graphique grand public suffise là où les premiers modèles de diffusion demandaient un centre de calcul.
Ce qui l'a rendu célèbre n'est pas sa qualité brute mais son ouverture : les poids se téléchargent, se modifient, se réentraînent. Des milliers de variantes spécialisées existent, du photoréalisme à l'illustration technique. Stable Diffusion n'est pas une application : c'est un fichier de modèle, que vous faites tourner dans l'interface de votre choix.
#Les versions, et laquelle choisir
Images et vidéos IA en local, sans limite : ComfyUI, Flux, Z-Image, Wan 2.2 sur ton GPU ou ton Mac — workflows prêts à charger, cadre légal inclus.
- Espace en ligne à vie
- PDF + fichiers
- Remboursé 30 j
| Version | Sortie | Résolution native | VRAM confortable | À retenir |
|---|---|---|---|---|
| Stable Diffusion 1.5 | 2022 | 512 × 512 | 4 à 6 Go | Léger, énorme bibliothèque de variantes et de LoRA. Détails et mains perfectibles. |
| SDXL 1.0 | 2023 | 1024 × 1024 | 8 Go | Le bon point de départ en 2026 : qualité nettement supérieure, écosystème mûr. |
| Stable Diffusion 3.5 | 2024 | 1024 × 1024 | 10 à 16 Go | Meilleur respect du prompt et du texte dans l'image. Licence différente, voir plus bas. |
D'autres familles ouvertes partagent désormais le terrain, comme Flux ou Z-Image, et s'utilisent dans les mêmes interfaces. Si vous débutez avec une carte de 8 Go, commencez par SDXL : c'est le meilleur rapport entre qualité, vitesse et documentation disponible.
#Le matériel nécessaire
| Votre matériel | Ce qui fonctionne bien |
|---|---|
| Carte NVIDIA 4 à 6 Go (GTX 1660, RTX 2060, RTX 3050) | SD 1.5 ; SDXL possible avec les options d'économie de mémoire, lentement |
| Carte NVIDIA 8 Go (RTX 3060 Ti, RTX 4060, RTX 5060) | SDXL confortablement |
| Carte NVIDIA 12 à 16 Go (RTX 3060 12 Go, RTX 4070, RTX 5070 Ti) | SDXL avec LoRA et agrandissement, SD 3.5, Flux en FP8 |
| Carte AMD récente (RX 7000, RX 9000) | Bon sous Linux avec ROCm ; plus laborieux sous Windows |
| Mac Apple Silicon, 16 Go et plus | Fonctionne sur toute puce M, plus lentement qu'une RTX équivalente |
| Pas de carte graphique | Techniquement possible, plusieurs minutes par image : à réserver au test |
#Quelle interface installer
| Interface | Pour qui | Forces | Limites |
|---|---|---|---|
| Fooocus | Débutants | Un champ de texte, un bouton, de bons réglages par défaut | SDXL uniquement, développement en maintenance |
| Forge | Utilisateurs réguliers | L'interface à onglets d'AUTOMATIC1111, en plus rapide et moins gourmande | Rythme de mises à jour irrégulier |
| AUTOMATIC1111 | Ceux qui suivent d'anciens tutoriels | L'interface historique, la plus documentée | Évolue peu désormais, plus lente que Forge |
| ComfyUI | Utilisateurs avancés et curieux | Prend en charge les nouveaux modèles avant tout le monde, workflows reproductibles | Courbe d'apprentissage |
| Draw Things | Mac, iPhone, iPad | Application native optimisée Apple Silicon, gratuite | Écosystème Apple seulement |
- Fooocus : l'installer et générer sa première image
- ComfyUI : installation et premiers pas
- Panorama : générer des images en local
#Le chemin le plus court par système
- 01Windows avec une carte NVIDIA
- 02Mac Apple Silicon
- 03Linux, ou carte AMD
- 04Vérifier que le GPU travaille
#Où trouver les modèles, et lesquels éviter
Deux sources dominent. Hugging Face héberge les modèles officiels des laboratoires. Civitai réunit les variantes communautaires : modèles affinés, LoRA, styles. Un LoRA est un petit fichier, de 10 à 300 Mo, qui ajoute un style ou un sujet à un modèle de base sans le remplacer ; il doit correspondre à la bonne famille, un LoRA SDXL ne fonctionnant pas sur SD 1.5.
#Écrire un prompt qui fonctionne
- Décrivez, ne commandez pas
- Ces modèles ne comprennent pas les consignes. « Portrait d'une femme âgée, lumière de fenêtre, objectif 85 mm, faible profondeur de champ » fonctionne ; « fais-moi une belle photo » non.
- Écrivez en anglais
- Les encodeurs de texte ont été entraînés très majoritairement sur de l'anglais. Le français est compris, moins finement.
- Sujet, puis cadre, puis style
- L'ordre compte : ce qui vient en premier pèse le plus.
- Le prompt négatif
- Il liste ce que vous ne voulez pas voir. Utile en SD 1.5 et SDXL, beaucoup moins dans les modèles récents.
- Gardez la graine
- Même graine, mêmes réglages, même image. Pour comparer deux prompts, fixez la graine et ne changez qu'une chose à la fois.
#Licences et usage commercial
| Modèle | Licence | Usage commercial des images |
|---|---|---|
| SD 1.5 | CreativeML OpenRAIL-M | Autorisé, avec des restrictions d'usage listées dans la licence |
| SDXL 1.0 | CreativeML OpenRAIL++-M | Autorisé, mêmes principes |
| SD 3.5 | Stability AI Community License | Gratuit sous un seuil de chiffre d'affaires annuel, licence entreprise au-delà : lire les conditions |
La licence du modèle ne règle pas tout : le droit d'auteur sur une image générée et l'utilisation de l'image d'une personne réelle relèvent du droit de votre pays, pas de la licence du logiciel.
#FAQ
Stable Diffusion est-il gratuit ?+
Peut-on utiliser Stable Diffusion sans carte graphique ?+
Quelle est la différence entre Stable Diffusion et Midjourney ?+
Mes images restent-elles privées ?+
Stable Diffusion ou Flux ?+
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.