Débutant 11 minImage

Stable Diffusion en local : installation et modèles

Stable Diffusion est un modèle de génération d'images à poids ouverts, publié en août 2022 par Stability AI avec des laboratoires universitaires. Il transforme un texte en image sur votre propre ordinateur, gratuitement, sans compte et sans limite de volume. Au 20 septembre 2026, c'est toujours la famille de modèles d'image la plus installée en local, avec l'écosystème le plus riche. Ce guide vous aide à choisir une version, une interface, et à produire votre première image sur Windows, Mac ou Linux.

Par Mohamed Meguedmi·Màj 2026-09-20·Testé sur Windows, macOS, Linux

#Stable Diffusion, c'est quoi ?

Stable Diffusion est un modèle de diffusion latente. Il part d'une image de bruit pur et la débruite pas à pas, guidé par votre texte, jusqu'à faire apparaître une image cohérente. Le calcul se fait dans un espace compressé, dit latent, ce qui explique qu'une carte graphique grand public suffise là où les premiers modèles de diffusion demandaient un centre de calcul.

Ce qui l'a rendu célèbre n'est pas sa qualité brute mais son ouverture : les poids se téléchargent, se modifient, se réentraînent. Des milliers de variantes spécialisées existent, du photoréalisme à l'illustration technique. Stable Diffusion n'est pas une application : c'est un fichier de modèle, que vous faites tourner dans l'interface de votre choix.

#Les versions, et laquelle choisir

Le kit Images IA

Images et vidéos IA en local, sans limite : ComfyUI, Flux, Z-Image, Wan 2.2 sur ton GPU ou ton Mac — workflows prêts à charger, cadre légal inclus.

  • Espace en ligne à vie
  • PDF + fichiers
  • Remboursé 30 j
VRAM : ordres de grandeur pour une image à la résolution native
VersionSortieRésolution nativeVRAM confortableÀ retenir
Stable Diffusion 1.52022512 × 5124 à 6 GoLéger, énorme bibliothèque de variantes et de LoRA. Détails et mains perfectibles.
SDXL 1.020231024 × 10248 GoLe bon point de départ en 2026 : qualité nettement supérieure, écosystème mûr.
Stable Diffusion 3.520241024 × 102410 à 16 GoMeilleur respect du prompt et du texte dans l'image. Licence différente, voir plus bas.

D'autres familles ouvertes partagent désormais le terrain, comme Flux ou Z-Image, et s'utilisent dans les mêmes interfaces. Si vous débutez avec une carte de 8 Go, commencez par SDXL : c'est le meilleur rapport entre qualité, vitesse et documentation disponible.

#Le matériel nécessaire

Cartes issues de la base matérielle QuelLLM · 20/09/2026
Votre matérielCe qui fonctionne bien
Carte NVIDIA 4 à 6 Go (GTX 1660, RTX 2060, RTX 3050)SD 1.5 ; SDXL possible avec les options d'économie de mémoire, lentement
Carte NVIDIA 8 Go (RTX 3060 Ti, RTX 4060, RTX 5060)SDXL confortablement
Carte NVIDIA 12 à 16 Go (RTX 3060 12 Go, RTX 4070, RTX 5070 Ti)SDXL avec LoRA et agrandissement, SD 3.5, Flux en FP8
Carte AMD récente (RX 7000, RX 9000)Bon sous Linux avec ROCm ; plus laborieux sous Windows
Mac Apple Silicon, 16 Go et plusFonctionne sur toute puce M, plus lentement qu'une RTX équivalente
Pas de carte graphiqueTechniquement possible, plusieurs minutes par image : à réserver au test

#Quelle interface installer

InterfacePour quiForcesLimites
FooocusDébutantsUn champ de texte, un bouton, de bons réglages par défautSDXL uniquement, développement en maintenance
ForgeUtilisateurs réguliersL'interface à onglets d'AUTOMATIC1111, en plus rapide et moins gourmandeRythme de mises à jour irrégulier
AUTOMATIC1111Ceux qui suivent d'anciens tutorielsL'interface historique, la plus documentéeÉvolue peu désormais, plus lente que Forge
ComfyUIUtilisateurs avancés et curieuxPrend en charge les nouveaux modèles avant tout le monde, workflows reproductiblesCourbe d'apprentissage
Draw ThingsMac, iPhone, iPadApplication native optimisée Apple Silicon, gratuiteÉcosystème Apple seulement

#Le chemin le plus court par système

  1. 01
    Windows avec une carte NVIDIA
  2. 02
    Mac Apple Silicon
  3. 03
    Linux, ou carte AMD
  4. 04
    Vérifier que le GPU travaille

#Où trouver les modèles, et lesquels éviter

Deux sources dominent. Hugging Face héberge les modèles officiels des laboratoires. Civitai réunit les variantes communautaires : modèles affinés, LoRA, styles. Un LoRA est un petit fichier, de 10 à 300 Mo, qui ajoute un style ou un sujet à un modèle de base sans le remplacer ; il doit correspondre à la bonne famille, un LoRA SDXL ne fonctionnant pas sur SD 1.5.

!
Deux précautions
Ne téléchargez que des fichiers .safetensors : l'ancien format .ckpt peut exécuter du code à l'ouverture. Et lisez la fiche de chaque modèle communautaire, car beaucoup sont entraînés sur des contenus dont l'usage commercial est interdit ou juridiquement incertain.

#Écrire un prompt qui fonctionne

Décrivez, ne commandez pas
Ces modèles ne comprennent pas les consignes. « Portrait d'une femme âgée, lumière de fenêtre, objectif 85 mm, faible profondeur de champ » fonctionne ; « fais-moi une belle photo » non.
Écrivez en anglais
Les encodeurs de texte ont été entraînés très majoritairement sur de l'anglais. Le français est compris, moins finement.
Sujet, puis cadre, puis style
L'ordre compte : ce qui vient en premier pèse le plus.
Le prompt négatif
Il liste ce que vous ne voulez pas voir. Utile en SD 1.5 et SDXL, beaucoup moins dans les modèles récents.
Gardez la graine
Même graine, mêmes réglages, même image. Pour comparer deux prompts, fixez la graine et ne changez qu'une chose à la fois.

#Licences et usage commercial

ModèleLicenceUsage commercial des images
SD 1.5CreativeML OpenRAIL-MAutorisé, avec des restrictions d'usage listées dans la licence
SDXL 1.0CreativeML OpenRAIL++-MAutorisé, mêmes principes
SD 3.5Stability AI Community LicenseGratuit sous un seuil de chiffre d'affaires annuel, licence entreprise au-delà : lire les conditions

La licence du modèle ne règle pas tout : le droit d'auteur sur une image générée et l'utilisation de l'image d'une personne réelle relèvent du droit de votre pays, pas de la licence du logiciel.

#FAQ

Stable Diffusion est-il gratuit ?+
Oui. Les modèles se téléchargent gratuitement et les interfaces qui les font tourner sont open source. En local, vous ne payez ni abonnement ni crédits, seulement votre matériel et l'électricité. Des services en ligne payants existent, mais ils ne sont pas nécessaires.
Peut-on utiliser Stable Diffusion sans carte graphique ?+
Oui, mais une image demande alors plusieurs minutes au lieu de quelques secondes. Pour un usage réel, comptez une carte NVIDIA de 6 à 8 Go, ou un Mac Apple Silicon avec 16 Go de mémoire.
Quelle est la différence entre Stable Diffusion et Midjourney ?+
Midjourney est un service en ligne payant, fermé, qui donne de beaux résultats sans réglage. Stable Diffusion est un modèle ouvert que vous faites tourner chez vous : gratuit, privé, entièrement personnalisable, au prix d'une installation et d'un apprentissage.
Mes images restent-elles privées ?+
Oui. En local, le prompt et l'image ne quittent pas votre machine. C'est l'une des principales raisons de choisir cette voie pour un travail confidentiel.
Stable Diffusion ou Flux ?+
Flux produit des images plus fidèles au prompt et gère mieux le texte, mais demande plus de VRAM : 12 à 16 Go en version allégée. SDXL reste le choix raisonnable sur une carte de 8 Go, avec un écosystème de variantes incomparable.

Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.