Stable Diffusion en local : installer et utiliser SD 3.5 gratuitement sur votre ordinateur



Stable Diffusion est le seul grand générateur d’images IA que vous pouvez installer sur votre propre ordinateur, sans abonnement, sans envoyer une image ni un prompt à l’extérieur. Ce n’est pas le plus simple à prendre en main, et ce n’est plus, en 2026, le plus performant sur la qualité brute. Mais pour une organisation qui manipule des visuels confidentiels, qui veut produire en volume sans compter, ou qui souhaite entraîner le modèle sur sa propre charte, il reste sans équivalent. Ce guide explique ce qu’est Stable Diffusion aujourd’hui, ce qu’il faut comme matériel, comment l’installer avec ComfyUI en une heure, comment produire une première image, et ce que disent les licences.
Cet article fait partie de notre guide complet des générateurs d’images IA, qui situe l’approche locale parmi les autres.
Réponse courte : comment utiliser Stable Diffusion gratuitement ? Installez ComfyUI (application de bureau pour Windows ou Mac), téléchargez le modèle Stable Diffusion 3.5 depuis Hugging Face, placez-le dans le dossier des modèles, chargez un flux de travail de base et tapez votre description. Il vous faut un ordinateur avec une carte graphique récente : 8 Go de mémoire vidéo au minimum, 16 Go pour être à l’aise. Le logiciel et le modèle sont gratuits, y compris pour un usage commercial, tant que votre organisation réalise moins d’un million de dollars de chiffre d’affaires par an.
En bref
Stable Diffusion est apparu en août 2022, développé par des chercheurs de l’université de Munich avec le soutien de Stability AI, et publié avec ses poids : n’importe qui pouvait le télécharger, l’exécuter et le modifier. C’est cette ouverture qui a créé, en trois ans, l’écosystème le plus riche de la génération d’images : des milliers de modèles dérivés, des interfaces, des extensions, des tutoriels dans toutes les langues.
Côté modèle, la dernière génération est Stable Diffusion 3.5, publiée le 22 octobre 2024 pour les versions Large et Large Turbo, le 29 octobre pour la version Medium (annonce Stability AI) :
L’ancien SDXL 1.0 (juillet 2023) reste très utilisé, parce qu’il dispose de la plus grande bibliothèque de modèles dérivés et d’extensions ; et SD 1.5 (2022) survit sur les machines modestes.
Deux choses à savoir avant d’aller plus loin. D’abord, il n’existe pas de Stable Diffusion 4. Des rumeurs et de faux liens de téléchargement circulent en 2026 ; la page d’actualités de Stability AI n’annonce aucun SD4, et la dernière version reste SD 3.5, qui approche de ses deux ans (Local AI Master, juillet 2026). Un lien « SD4 » est au mieux une confusion, au pire un logiciel malveillant. Ensuite, Stability AI a changé de cap. Sous la direction de Prem Akkaraju depuis 2024, l’entreprise s’est tournée vers la production créative pour les professionnels de la musique, de la vidéo et de l’image, avec des partenariats de co-développement avec Universal Music, Warner Music ou Electronic Arts, et une levée de 76 millions de dollars auprès de ces mêmes acteurs le 25 août 2026 (TechCrunch). Ses annonces de 2026 portent surtout sur l’audio. Le modèle d’images n’est pas abandonné, mais il n’est plus au centre.
Pour la qualité pure en open source, le relais est pris par d’autres modèles, dont Flux.2, que nous traitons dans un guide dédié. Stable Diffusion garde trois atouts que ces nouveaux venus n’ont pas encore : la taille de son écosystème, la modestie de ses besoins matériels avec SDXL et SD 1.5, et une licence claire.
Trois raisons justifient l’effort d’installation, et une seule suffit.
La confidentialité. Rien ne quitte votre ordinateur : ni vos prompts, ni vos images de référence, ni vos résultats. Pour un produit non lancé, un visuel de campagne sous embargo ou des documents internes, c’est le seul dispositif sans discussion avec le service juridique.
Le volume. Une fois installé, chaque image ne coûte que de l’électricité. Une équipe qui produit des centaines de variantes par semaine, ou qui génère des séries pour un catalogue, rentabilise vite le matériel.
Le contrôle. Vous choisissez le modèle, vous le combinez avec des modules complémentaires (les « LoRA », qui ajoutent un style, un produit ou un personnage), vous pouvez l’entraîner sur vos propres visuels. Aucun service en ligne n’offre ce degré de maîtrise.
Stable Diffusion calcule sur la carte graphique. C’est sa mémoire vidéo (VRAM) qui décide de ce que vous pouvez faire, bien plus que le processeur ou la mémoire vive.
| Modèle | Mémoire vidéo minimale | Recommandée | Pour quoi |
|---|---|---|---|
| SD 1.5 | 4 Go | 6 à 8 Go | Machines modestes, ordinateurs portables anciens |
| SDXL 1.0 | 6 Go | 12 Go (16 Go avec le module d’affinage) | Le meilleur rapport écosystème / matériel |
| SD 3.5 Medium | 8 Go | 12 à 16 Go | Le choix par défaut sur une carte grand public récente |
| SD 3.5 Large | 12 Go avec optimisations | 24 Go | La qualité maximale, sur station de travail |
Repères issus d’un guide de configuration mis à jour le 24 septembre 2026 ; les besoins varient selon l’interface et les optimisations (versions compressées FP8 ou GGUF, qui réduisent la mémoire nécessaire de 40 à 50 %).
Autour de la carte graphique, prévoyez 16 Go de mémoire vive (32 Go si vous voulez décharger une partie du modèle sur le processeur), et un disque SSD avec de la place : chaque modèle pèse entre 2 et 24 Go, et une installation vivante en accumule vite une dizaine. Côté systèmes, Windows 11 et Linux avec une carte NVIDIA sont la voie la plus balisée ; les cartes AMD sont de mieux en mieux prises en charge, et Stability AI a publié des versions optimisées de SD 3.5 et SDXL pour les Radeon. Sur Mac, l’application ComfyUI demande une puce Apple Silicon (M1 ou plus récente) et macOS 13 au minimum, les Mac Intel n’étant pas pris en charge (documentation ComfyUI pour macOS) ; le calcul est plus lent qu’avec une carte NVIDIA équivalente, mais utilisable pour SDXL et SD 3.5 Medium sur les machines bien dotées en mémoire unifiée.
Le test avant d’acheter. Si votre organisation dispose déjà d’un poste de montage vidéo ou de CAO, il fera l’affaire. Sinon, avant d’investir dans une machine, testez Stable Diffusion sur un service de calcul à la demande pendant quelques heures : vous saurez si l’usage justifie l’achat.
ComfyUI est devenu l’interface de référence : c’est celle que les nouveaux modèles prennent en charge en premier, et son application de bureau a fait disparaître la plupart des manipulations en ligne de commande. Les autres interfaces (Forge, Automatic1111, qui ont fait l’histoire de Stable Diffusion) restent utilisables, mais sont moins vite mises à jour.
Identifiez votre carte graphique et sa mémoire vidéo (sur Windows, dans le Gestionnaire des tâches, onglet Performance). Mettez à jour ses pilotes. Libérez au moins 50 Go sur un disque SSD.
Téléchargez l’application de bureau sur comfy.org. Elle existe pour Windows 10 et suivants, et pour les Mac Apple Silicon sous macOS 13 et suivants ; elle gère elle-même son environnement technique et permet plusieurs installations en parallèle, en réservant environ 5 Go par installation (documentation ComfyUI). Une carte graphique dédiée est recommandée, pas obligatoire : sans elle, le calcul se fait sur le processeur, très lentement.
Les modèles Stable Diffusion 3.5 sont distribués sur Hugging Face, la plateforme de référence des modèles ouverts. La page du modèle demande d’accepter la licence communautaire de Stability AI avant le téléchargement. Lisez-la : c’est elle qui fixe vos droits d’usage (voir plus bas).
Depuis la page de SD 3.5 Large ou celle de SD 3.5 Medium, téléchargez le fichier du modèle. SD 3.5 utilise trois encodeurs de texte (deux modèles CLIP et un modèle T5), qui traduisent votre description en instructions pour le modèle ; ils se téléchargent séparément. Comptez de 5 à 16 Go selon la variante, et une version compressée si votre carte a peu de mémoire.
ComfyUI attend chaque type de fichier dans un sous-dossier précis de son dossier de modèles : le modèle principal dans checkpoints, les encodeurs de texte dans clip (ou text_encoders selon la version). Sur Windows, ce dossier partagé se trouve dans le profil utilisateur, sous Comfy-Desktop. Redémarrez l’application pour qu’elle les détecte.
ComfyUI fonctionne par flux de travail : un enchaînement de blocs (chargement du modèle, encodage du texte, génération, décodage) reliés entre eux. L’application fournit des modèles de flux prêts à l’emploi pour SD 3.5. Chargez-en un, sélectionnez votre modèle dans le premier bloc, écrivez votre prompt dans le bloc de texte positif, ce que vous ne voulez pas dans le bloc négatif, puis lancez. La première image met plus de temps (chargement du modèle en mémoire) ; les suivantes prennent de quelques secondes à une minute selon votre carte.
Une fois l’installation faite, quatre réglages font la différence, tous visibles dans le flux de travail.
Le prompt et le prompt négatif. SD 3.5 comprend les phrases complètes ; décrivez le sujet, le style, la lumière, le cadrage. Le prompt négatif liste ce que vous refusez : texte, filigrane, déformations, mains supplémentaires.
Le nombre d’étapes. De 20 à 30 pour SD 3.5 Medium et Large, 4 pour la version Turbo. Plus d’étapes ne veut pas dire meilleure image au-delà d’un certain seuil, seulement plus de temps.
L’échelle de guidage (CFG). Elle règle la fidélité au prompt : autour de 4 à 5 pour SD 3.5, plus haut et l’image devient saturée et rigide.
La graine (seed). Un nombre qui fixe le hasard. Gardez-la identique pour comparer deux prompts, changez-la pour explorer.
Un prompt de départ, à adapter :
Positif : photographie éditoriale d'un atelier de formation en petit
groupe dans une salle lumineuse, personnes vues de dos, lumière naturelle
latérale, tons neutres et bleu nuit, profondeur de champ courte,
composition équilibrée, haute qualité.
Négatif : texte, logo, filigrane, visages déformés, mains supplémentaires,
flou de mouvement, basse résolution.Pour aller plus loin, l’écosystème apporte trois outils que vous ne trouverez pas ailleurs à ce degré :
C’est le point sur lequel Stable Diffusion est plus clair que la plupart de ses concurrents ouverts.
La licence communautaire de Stability AI couvre SD 3.5 et les modèles récents. Elle est gratuite pour la recherche, l’usage non commercial et l’usage commercial des particuliers et des organisations dont le chiffre d’affaires annuel est inférieur à un million de dollars ; au-delà, une licence entreprise payante est nécessaire (Stability AI, mise à jour de licence). Les utilisateurs commerciaux sous le seuil doivent remplir un court formulaire d’enregistrement, sans paiement. Vous conservez les images produites, les modèles affinés et les produits dérivés, dans le respect de la politique d’usage acceptable.
Les modèles plus anciens (SDXL, SD 1.5) sont sous des licences ouvertes de type OpenRAIL, qui autorisent l’usage commercial et interdisent une liste d’usages nuisibles.
Les modèles dérivés publiés par la communauté ont chacun leur licence, parfois plus restrictive que celle du modèle de base. Avant d’utiliser un modèle affiné dans un projet commercial, lisez sa page.
Le droit d’auteur, côté français. Comme pour tout générateur, une image produite à partir d’une description a peu de chances d’être protégée : vous pouvez l’utiliser, mais difficilement empêcher sa réutilisation. Vous restez responsable de ce qu’elle montre, et le risque de reproduire un style ou une œuvre identifiable existe avec les modèles dérivés entraînés sur des artistes précis. Notre article sur les droits d’auteur des images IA en France détaille ce point.
La transparence. Contrairement aux outils en ligne, un modèle local n’ajoute aucun marquage automatique à vos images. L’article 50 de l’AI Act, applicable depuis le 2 août 2026, impose de signaler les images générées réalistes qui pourraient être prises pour vraies : avec Stable Diffusion, cette mention dépend entièrement de vous. Prévoyez-la dans votre procédure de publication.
Visuels de produits non lancés. Mise en scène d’un prototype, déclinaisons de packaging, maquettes de campagne avant annonce : rien ne sort de l’entreprise.
Séries en volume. Catalogue, fiches produits, variantes pour tests publicitaires : des centaines d’images sans quota ni surcoût.
Charte graphique stricte. Un LoRA entraîné sur vos propres visuels reproduit votre style avec une fidélité qu’aucun outil en ligne n’atteint.
Formation et pédagogie. Un poste équipé dans un organisme de formation permet de faire pratiquer la génération d’images à des groupes entiers sans gérer des comptes et des quotas individuels, et sans que les productions des stagiaires quittent la salle.
Ce qui ne s’impose pas. Pour une illustration occasionnelle, l’assistant que vous avez déjà suffit ; pour un rendu esthétique maximal sans effort, Midjourney reste devant. Le local est un choix de méthode, pas un choix par défaut.
L’installation demande une personne référente. Une fois en place, l’outil s’utilise sans compétence technique ; l’installer, le mettre à jour et résoudre les incidents demande quelqu’un qui n’a pas peur d’un dossier de fichiers. Dans une PME, c’est souvent le point bloquant.
La qualité brute n’est plus la meilleure. Sur le réalisme et le suivi de consignes complexes, les modèles récents (Flux.2 en tête côté ouvert, Midjourney et ChatGPT Images côté fermé) dépassent SD 3.5. L’écart se comble avec de bons modèles dérivés et des réglages soignés, mais il existe.
L’écosystème est foisonnant, donc désordonné. Des milliers de modèles et d’extensions, de qualité et de licence variables. Tenez une liste courte de ce que votre organisation autorise.
Le matériel vieillit. Une carte graphique de 2023 fera tourner SDXL longtemps ; SD 3.5 Large et les modèles qui suivront demandent plus. Prévoyez le renouvellement.
Aucune garantie contractuelle. Pas de support, pas d’indemnisation, pas d’engagement de l’éditeur : c’est le prix de la gratuité.
Installer Stable Diffusion prend une heure ; savoir s’en servir en équipe prend un peu plus. Les organisations qui en tirent le plus ont posé trois choses avant de générer la première image : une personne référente pour l’installation et les mises à jour, une liste de modèles et d’extensions autorisés, et une procédure de vérification et de signalement des images avant publication. L’article 4 de l’AI Act, dans sa version modifiée par le règlement Omnibus en vigueur depuis le 27 juillet 2026, demande d’ailleurs aux organisations qui utilisent l’IA de prendre des mesures pour développer la maîtrise de ces outils par leur personnel. Notre atelier de mise en place d’un générateur d’images local pour les équipes couvre ces trois points, sur votre matériel et vos cas d’usage.
Oui, le logiciel et les modèles sont gratuits, y compris pour un usage commercial, tant que votre organisation réalise moins d’un million de dollars de chiffre d’affaires annuel ; au-delà, Stability AI demande une licence entreprise. Ce qui n’est pas gratuit, c’est le matériel : une carte graphique avec au moins 8 Go de mémoire vidéo, et de préférence 16 Go, ainsi que le temps d’installation et de prise en main. Pour une image occasionnelle, un outil en ligne revient moins cher ; pour un usage régulier ou confidentiel, le local est vite rentabilisé.
Tout dépend du modèle. SD 1.5 tourne avec 4 Go de mémoire vidéo, SDXL avec 6 à 8 Go, SD 3.5 Medium demande 8 Go au minimum et 12 à 16 Go pour être à l’aise, SD 3.5 Large 24 Go pour un usage confortable. Une carte NVIDIA RTX de série 30 ou plus récente est la voie la plus simple ; les cartes AMD et les Mac Apple Silicon fonctionnent aussi, avec un peu moins de vitesse et de compatibilité. Les versions compressées des modèles réduisent les besoins de 40 à 50 %.
Non. Au 28 septembre 2026, la dernière version publiée par Stability AI reste Stable Diffusion 3.5, sortie en octobre 2024. Des rumeurs et de faux liens de téléchargement « SD4 » circulent : ne les suivez pas, ils sont au mieux une confusion, au pire un logiciel malveillant. Les modèles ouverts plus récents portent d’autres noms, Flux.2 en premier lieu, et se téléchargent eux aussi depuis Hugging Face.
Non. L’application de bureau ComfyUI s’installe comme n’importe quel logiciel, et les flux de travail fournis permettent de générer une image sans écrire une ligne de code. Il faut en revanche accepter de manipuler des fichiers, de les ranger dans les bons dossiers et de comprendre quelques réglages (étapes, guidage, graine). Dans une équipe, une personne à l’aise avec l’informatique prend l’installation en charge ; les autres utilisent ensuite l’outil comme un service en ligne.
Mieux que tout outil en ligne, à condition d’y consacrer un peu de temps. La méthode consiste à entraîner un petit module complémentaire, appelé LoRA, sur une vingtaine à une centaine de vos propres visuels : quelques heures de calcul sur votre machine, et le modèle produit ensuite des images dans votre style. C’est l’usage le plus différenciant du local, et celui qui justifie le mieux l’investissement pour une équipe communication.
Oui, si vous générez sur votre propre ordinateur : les prompts, les images de référence et les résultats ne quittent pas votre machine, et aucun compte n’est nécessaire pour générer. Les seuls échanges avec l’extérieur sont le téléchargement des modèles et des extensions, et les mises à jour de l’interface. Veillez à télécharger vos modèles depuis des sources connues, Hugging Face en premier lieu, pour éviter les fichiers malveillants.
Les deux s’installent chez vous, avec ComfyUI. Flux.2 donne aujourd’hui de meilleures images sur le réalisme et le suivi de consignes complexes, mais sa version ouverte demande une licence commerciale séparée et davantage de mémoire vidéo. Stable Diffusion garde l’écosystème le plus fourni, des besoins matériels plus modestes avec SDXL, et une licence claire jusqu’à un million de dollars de chiffre d’affaires. Notre guide de Flux.2 détaille l’arbitrage ; beaucoup d’équipes installent les deux.
Stable Diffusion en local n’est pas l’outil de tout le monde, et ce n’est plus le plus performant sur la qualité brute. C’est l’outil de ceux qui ont une raison précise : la confidentialité, le volume ou le contrôle d’un style. Pour eux, une heure d’installation et une carte graphique correcte donnent un générateur sans quota, sans abonnement et sans fuite de données, avec un écosystème que personne d’autre n’a. La condition est d’organiser l’usage avant de générer : une personne référente, une liste de modèles autorisés, une procédure de vérification. Pour mettre cela en place dans votre équipe, notre parcours IA générative avec un générateur d’images installé chez vous part de votre matériel et de vos cas réels.

30 septembre 2026
Intelligence Artificielle – IA


30 septembre 2026
Intelligence Artificielle – IA


30 septembre 2026
Intelligence Artificielle – IA

Laisser un commentaire