Générateur d’images IA : le guide complet (Midjourney, ChatGPT Images, Flux, Ideogram, Firefly)



Un générateur d’images IA transforme une phrase en image. Vous décrivez ce que vous voulez, l’outil produit un visuel en quelques secondes, et vous pouvez le retoucher par simple demande. En trois ans, ces outils sont passés du gadget à l’usage courant : illustration d’un support de formation, visuel de réseau social, image d’une fiche produit, maquette pour un client. Ce qui a changé en 2026, c’est moins la qualité, désormais très bonne partout, que la question du choix. DALL-E a disparu de ChatGPT, Midjourney a quitté son image de club Discord, les modèles open source tournent sur un ordinateur portable, et l’AI Act impose depuis le 2 août 2026 des règles de transparence sur les images publiées. Ce guide vous donne les repères pour choisir un outil selon votre usage, produire une image utilisable au travail et rester dans les règles.
Il ouvre notre série consacrée à la génération d’images, et complète nos guides sur la création de présentations avec l’IA et sur la génération d’images dans Gemini avec Nano Banana.
Réponse courte : quel générateur d’images IA choisir ? Si vous avez déjà ChatGPT, commencez par ChatGPT Images, inclus jusque dans la version gratuite. Pour des visuels très soignés et un style affirmé, Midjourney reste la référence, à partir de 10 $ par mois. Pour un usage commercial sans inquiétude juridique, Adobe Firefly est le seul grand outil entraîné sur des contenus sous licence. Pour du texte lisible dans l’image (affiche, logo, bannière), Ideogram. Pour installer un modèle sur votre propre machine, Flux.2 ou Stable Diffusion. Dans tous les cas, prévoyez de retoucher, de vérifier les droits et de signaler l’origine IA quand l’image se veut réaliste.
En bref
Un générateur d’images IA repose sur un modèle entraîné sur des centaines de millions d’images accompagnées de descriptions. À force d’exemples, le modèle a appris les correspondances entre les mots et les formes : ce à quoi ressemble « un bureau lumineux en style aquarelle » ou « un logo minimaliste bleu nuit ». Quand vous saisissez une description, appelée prompt, le modèle part d’un bruit visuel aléatoire et le transforme progressivement en une image cohérente avec votre demande.
Trois évolutions récentes changent l’usage au quotidien.
Le texte dans l’image est devenu lisible. Pendant longtemps, les lettres générées formaient des mots imaginaires. Les modèles de 2026 écrivent correctement dans la plupart des cas, ce qui ouvre les affiches, les bannières et les visuels avec slogan.
La retouche par conversation. Vous ne régénérez plus toute l’image pour changer un détail : vous demandez « remplace le fond par un mur blanc » ou « ajoute une plante à droite », et l’outil modifie l’élément visé. ChatGPT Images, Nano Banana et Firefly fonctionnent ainsi.
La cohérence entre images. Reproduire le même personnage, le même produit ou le même style sur une série de visuels était impossible ; c’est devenu une fonction standard, avec des images de référence.
Ce que le modèle ne fait toujours pas : comprendre votre marque, connaître vos produits ou vérifier qu’une scène est plausible. Il produit ce qui ressemble le plus à votre description. Tout le travail consiste à décrire précisément, puis à regarder de près.
Plutôt qu’un classement, qui change à chaque mise à jour, retenez cinq approches. Chacune correspond à un besoin, et à un outil de référence que nous détaillons dans un guide dédié.
Si vous utilisez déjà ChatGPT, vous avez un générateur d’images sous la main. ChatGPT Images 2.0 est arrivé le 21 avril 2026 sur toutes les formules, gratuite comprise, et la version 2.5 du 8 septembre 2026 a ajouté des modèles de départ, la transformation d’un croquis en image et la retouche depuis le mobile (notes de version OpenAI). Les formules payantes disposent en plus d’un mode « Images with thinking », où le modèle planifie l’image avant de la produire.
Le point fort, c’est le contexte : vous pouvez enchaîner une conversation, un document et une image dans le même fil, et retoucher par phrases. Le point faible reste un style un peu uniforme et des quotas serrés en version gratuite. Notre article sur la fin de DALL-E et la génération d’images dans ChatGPT détaille la bascule.
Midjourney reste l’outil que citent les graphistes quand on parle de rendu. V8.1 est le modèle par défaut depuis le 11 juin 2026, et un mode Draft lancé le 16 juin produit 24 images d’essai pour la moitié du coût d’une génération classique. L’outil se pratique désormais surtout sur le site midjourney.com, ouvert à tous depuis 2024 ; Discord reste utilisable. Il n’existe pas d’essai gratuit : quatre abonnements, de 10 à 120 $ par mois, avec des images illimitées en mode lent à partir de la formule Standard (documentation Midjourney).
Sa force est esthétique : lumière, matières, composition. Sa contrainte est l’apprentissage : les paramètres et le vocabulaire du prompt demandent quelques heures de pratique. C’est pour cette raison que nous proposons une formation dédiée à la création d’images avec Midjourney, et un guide complet de Midjourney dans cette série.
Adobe a fait un choix que personne d’autre n’a fait à cette échelle : entraîner son modèle sur des contenus sous licence et du domaine public, et attacher automatiquement des informations de provenance (Content Credentials) à chaque image. Les clients entreprise peuvent bénéficier d’une indemnisation en cas de litige de propriété intellectuelle (page des offres Firefly). Pour une direction juridique, c’est l’argument décisif.
Firefly s’utilise seul, sur le web, ou dans Photoshop, Illustrator et Express. Firefly AI Assistant, l’agent créatif présenté le 15 avril 2026, enchaîne plusieurs opérations à partir d’une consigne, dans Firefly puis dans les applications Creative Cloud ; l’application donne aussi accès à plus de trente modèles partenaires, dont Nano Banana 2, Veo 3.1 et Kling 3.0.
💡 À ne pas confondre avec un agent IA : générer ou retoucher une image reste une action que vous déclenchez et validez. Firefly AI Assistant, comme d’autres fonctions d’agent apparues en 2026, enchaîne plusieurs étapes à votre place : ces usages relèvent d’une autre logique et d’un autre encadrement. Pour les comprendre, voir notre cocon Agents IA.
Ideogram s’est construit sur un problème que les autres résolvaient mal : écrire du texte juste, bien placé, dans une image. Affiches, bannières, visuels avec slogan, propositions de logos : c’est son terrain. La version gratuite est devenue très limitée (10 crédits lents par semaine, images publiques), et les formules payantes démarrent autour de 15 à 20 $ par mois selon la facturation (relevé eesel, juin 2026). Les autres outils ont progressé sur le texte, mais Ideogram garde une longueur d’avance sur la typographie et la mise en page.
Dernière approche, pour ceux qui veulent tout garder en interne. Un modèle « open weights » se télécharge et s’exécute sur votre propre ordinateur, sans envoyer une image ni un prompt à l’extérieur. Flux.2, publié par Black Forest Labs le 25 novembre 2025, existe en version [dev] à 32 milliards de paramètres, gratuite pour un usage non commercial et exécutable sur une carte graphique grand public, (annonce Black Forest Labs), et depuis le 15 janvier 2026 en version [klein], plus légère, dont le modèle 4B est sous licence Apache 2.0, donc libre pour un usage commercial. Stable Diffusion 3.5 reste le modèle le mieux entouré en outils, extensions et tutoriels, et des modèles récents comme Qwen-Image sont publiés sous licence libre, donc utilisables commercialement.
Le prix d’entrée est nul, mais l’investissement se déplace : une carte graphique récente, quelques heures d’installation, et une vigilance sur les licences, car « open weights » ne signifie pas toujours « libre pour un usage commercial ».
Google propose Nano Banana dans Gemini, avec une version 2 sortie fin février 2026 : nous l’avons traité dans notre guide de la création visuelle avec Gemini. Recraft, avec sa version 4 de février 2026, se distingue par la génération vectorielle et les styles de marque ; Leonardo, racheté par Canva, alimente les fonctions d’image de Canva. Chacun aura son guide dans cette série quand il apporte quelque chose de différent.
La qualité d’une image générée dépend à 80 % de la demande. Voici la méthode que nous faisons pratiquer en formation, valable quel que soit l’outil.
1. Définir l’usage. Une illustration de diapositive, une image de bannière web et un visuel imprimé n’ont ni le même format, ni la même exigence de qualité, ni les mêmes contraintes de droits. Fixez le support, la taille et la durée de vie de l’image avant d’ouvrir un outil.
2. Choisir l’approche. Reprenez les cinq approches ci-dessus. Pour un usage interne rapide, l’assistant que vous avez déjà. Pour une publication commerciale, Firefly ou un outil dont vous avez lu les conditions. Pour du texte dans l’image, Ideogram.
3. Décrire. Un bon prompt d’image contient cinq éléments : le sujet, le style, le cadrage, la lumière et le format. Exemple à adapter :
Photographie réaliste d'une formatrice devant un petit groupe
dans une salle de formation moderne et lumineuse, vue de trois quarts,
lumière naturelle venant d'une grande fenêtre à gauche,
tons neutres et bleu nuit, personnes de dos ou floues au premier plan,
aucun texte, aucun logo, format 16:9.Ce prompt précise ce que l’image ne doit pas contenir, ce qui évite les faux logos et les textes illisibles. Précisez aussi « aucune personne réelle identifiable » si l’image doit être publiée.
4. Générer plusieurs variantes. Ne jugez jamais sur une seule image. Générez quatre à huit propositions, comparez, puis affinez la description à partir de celle qui s’approche le plus du résultat.
5. Retoucher par demande ciblée. Une fois la bonne base trouvée, modifiez élément par élément : le fond, un objet, la couleur d’un vêtement. Tous les outils de 2026 le permettent, et c’est bien moins coûteux qu’une régénération complète.
6. Vérifier. Quatre contrôles avant toute utilisation : les mains, les objets et le texte (les erreurs y sont encore fréquentes) ; l’absence de ressemblance avec une personne réelle ou une œuvre connue ; l’absence de logo ou de marque tierce ; les conditions d’utilisation de l’outil pour votre cas.
7. Signaler l’origine IA. Si l’image se veut réaliste et représente une scène qui pourrait être prise pour vraie, mentionnez qu’elle a été générée par IA. Nous y revenons plus bas, car c’est désormais une obligation dans certains cas.
Pour les formateurs. Illustrer une notion abstraite, créer une image par étude de cas, produire des visuels cohérents pour un parcours complet : ce qui prenait une matinée de recherche de banque d’images prend une heure. Le gain le plus net porte sur les mises en situation : une scène de vente, un poste de travail, une réunion tendue, générées dans le style de votre organisme.
Pour la communication. Visuels de réseaux sociaux, illustrations d’articles, images d’en-tête de newsletter. La condition est la cohérence : même style, même palette, même traitement d’une image à l’autre. Notre article sur la production de visuels marketing cohérents avec votre charte donne la méthode.
Pour le commerce et le produit. Mise en scène d’un produit dans plusieurs décors, maquettes avant fabrication, visuels de proposition. Attention aux attentes : une image générée ne remplace pas la photo contractuelle d’un produit réel.
Pour tout le monde, une limite. Une image générée n’est jamais une preuve. Dans un support de formation, une image qui montre une manipulation technique, un écran de logiciel ou un geste professionnel doit être une vraie capture ou une vraie photo : le modèle invente des boutons, des câbles et des gestes qui n’existent pas.
Deux questions distinctes se posent : que pouvez-vous faire d’une image générée, et que devez-vous dire à ceux qui la voient ?
Ce que vous pouvez en faire. En droit français, une œuvre est protégée si elle porte l’empreinte de la personnalité de son auteur. Une image produite par une machine à partir d’une simple description ne remplit pas facilement ce critère : vous ne pouvez pas compter sur le droit d’auteur pour empêcher quelqu’un de la réutiliser. Les conditions d’utilisation de chaque outil fixent le reste : Midjourney autorise l’usage commercial aux abonnés, mais impose la formule Pro ou Mega aux entreprises réalisant plus d’un million de dollars de chiffre d’affaires annuel (documentation Midjourney) ; Flux.2 [dev] exige une licence commerciale ; Firefly accompagne les entreprises d’une indemnisation. Reste le risque de reproduire, sans le vouloir, un style ou une œuvre identifiable : c’est l’objet de notre article sur les droits d’auteur des images IA en France.
Ce que vous devez dire. L’article 50 de l’AI Act s’applique depuis le 2 août 2026, sans report (Iones, analyse des obligations d’août 2026). Il impose deux choses. Les fournisseurs d’outils doivent marquer les images générées de façon lisible par une machine ; pour les systèmes mis sur le marché avant août, le règlement Omnibus leur laisse jusqu’au 2 décembre 2026. Les organisations qui publient ces images doivent de leur côté signaler clairement les contenus réalistes qui représentent des personnes, des lieux ou des événements de façon trompeuse, ce que le texte appelle les hypertrucages (Leto, code de bonne conduite). Une illustration manifestement stylisée n’est pas concernée ; une fausse photo de réunion présentée comme réelle, si. Un code de bonne conduite européen, publié en juin 2026, précise les pratiques attendues ; il n’est pas contraignant, mais c’est la référence à suivre. Les sanctions prévues montent jusqu’à 15 millions d’euros ou 3 % du chiffre d’affaires mondial, avec des seuils réduits pour les PME.
Le réflexe simple : une mention « image générée par IA » dans la légende ou les métadonnées dès que l’image pourrait être prise pour une photographie.
| Approche | Outil | Entrée de gamme | Ce qu’il faut savoir |
|---|---|---|---|
| Assistant généraliste | ChatGPT Images | Inclus dans ChatGPT, dès la version gratuite (quotas limités) | Mode « avec réflexion » réservé aux formules payantes |
| Outil spécialisé | Midjourney | 10 $ par mois (Basic), 8 $ en annuel ; images illimitées en mode lent dès Standard à 30 $ | Pas d’essai gratuit ; Pro ou Mega obligatoire au-delà d’un million de dollars de CA |
| Usage commercial sécurisé | Adobe Firefly | 11,08 € par mois (Standard, 2 000 crédits) ; 22,18 € pour Pro (4 000 crédits) | Crédits partagés entre image, vidéo et retouche ; remise temporaire sur certaines formules |
| Texte lisible | Ideogram | Gratuit très limité ; Plus environ 20 $ par mois, 15 $ en annuel (1 000 crédits) | Une image coûte 2 à 6 crédits selon la qualité |
| Modèle installé chez vous | Flux.2 [dev], Stable Diffusion 3.5 | 0 € | Carte graphique nécessaire ; licence commerciale à vérifier |
Tarifs relevés le 28 septembre 2026 sur les pages officielles de Midjourney et d’Adobe, et sur un relevé de juin 2026 pour Ideogram, dont la page tarifaire change souvent. Vérifiez avant de souscrire.
Pour un usage individuel régulier, comptez donc entre 0 et 12 € par mois. Le poste de dépense réel est ailleurs : le temps passé à décrire, trier, retoucher et vérifier. Une équipe qui produit dix visuels par semaine sans méthode y passe plus de temps qu’avec une banque d’images. Avec une méthode, elle divise ce temps par trois ou quatre. C’est là que la formation se rentabilise, pas sur le choix de l’abonnement.
Les détails qui trahissent. Mains, dents, reflets, texte en arrière-plan, objets qui se fondent l’un dans l’autre : les modèles de 2026 se trompent moins, mais se trompent encore. Regardez chaque image à taille réelle avant de la publier.
L’uniformité. À force d’utiliser le même outil avec les mêmes mots, tous vos visuels se ressemblent, et ressemblent à ceux de vos concurrents. Construisez un vocabulaire de style propre à votre organisation et changez de référence visuelle de temps en temps.
Les personnes réelles. Ne générez jamais une image représentant une personne identifiable sans son accord, même pour un usage interne, et refusez les demandes de « photo réaliste de tel dirigeant ». Les outils sérieux bloquent ces requêtes ; la responsabilité reste la vôtre.
Les données. Ce que vous envoyez à un outil en ligne (photos de produits non lancés, visages de collaborateurs, documents) est traité sur les serveurs de l’éditeur. Pour les contenus sensibles, préférez un modèle installé chez vous ou une offre entreprise avec engagement contractuel.
Le remplacement des métiers créatifs. Un générateur produit vite des images correctes. Il ne produit pas une direction artistique, une identité visuelle ni un visuel de campagne qui tient sur trois ans. Les organisations qui obtiennent les meilleurs résultats font travailler ensemble un graphiste et l’outil, pas l’un à la place de l’autre.
Les outils changent tous les trois mois ; la méthode, non. Savoir décrire une image, juger un résultat, retoucher sans tout refaire, vérifier les droits et signaler l’origine IA : ces cinq compétences valent pour tous les générateurs, y compris ceux qui sortiront l’an prochain. L’article 4 de l’AI Act, dans sa version modifiée par le règlement Omnibus en vigueur depuis le 27 juillet 2026, demande d’ailleurs aux organisations qui utilisent l’IA de prendre des mesures pour développer la maîtrise de ces outils par leur personnel.
Notre parcours pour produire des images avec l’IA dans le respect des droits et de la charte est conçu dans cet esprit : les stagiaires travaillent sur leurs propres supports, avec les outils de leur organisation, et repartent avec un vocabulaire de style et une procédure de vérification. Les guides de cette série, un par outil, prolongent ce travail article par article.
Cela dépend de ce que vous appelez gratuit. ChatGPT Images est inclus dans la version gratuite de ChatGPT, avec des quotas limités, et Nano Banana dans Gemini fonctionne sur le même principe. Ideogram a réduit sa version gratuite à quelques crédits par semaine, avec des images publiques. Midjourney n’a plus d’essai gratuit depuis 2023. La seule option vraiment gratuite et illimitée consiste à installer un modèle open source, Flux.2 ou Stable Diffusion, sur un ordinateur équipé d’une carte graphique récente : le logiciel ne coûte rien, le matériel et le temps d’installation, si.
Le plus souvent oui, dans les conditions fixées par l’outil. Midjourney autorise l’usage commercial aux abonnés, avec une formule supérieure obligatoire pour les grandes entreprises ; Firefly est conçu pour cet usage et indemnise ses clients entreprise ; Flux.2 [dev] demande une licence commerciale. Deux réserves s’appliquent partout : vous ne pourrez probablement pas revendiquer de droit d’auteur sur l’image, et vous restez responsable si elle reproduit une œuvre, un style identifiable, une marque ou une personne réelle.
Depuis le 2 août 2026, l’article 50 de l’AI Act impose de signaler les contenus générés qui représentent de façon réaliste des personnes, des lieux ou des événements pouvant être pris pour vrais. Une illustration manifestement stylisée n’est pas concernée. Dans le doute, une mention « image générée par IA » en légende ne coûte rien et protège votre crédibilité. Les outils ajoutent aussi un marquage invisible dans le fichier, obligatoire au plus tard le 2 décembre 2026 pour les systèmes antérieurs à août.
Non. OpenAI a retiré DALL-E de son API le 12 mai 2026 et le GPT DALL-E de ChatGPT le 30 août 2026. La génération d’images dans ChatGPT passe désormais par ChatGPT Images, disponible sur toutes les formules, dont la version 2.5 est sortie le 8 septembre 2026. Si vous aviez des images créées avec DALL-E dans ChatGPT, elles n’ont pas été transférées : il fallait les télécharger avant la date limite.
Oui, mais ce n’est plus le lieu principal. Depuis 2024, le site midjourney.com est ouvert à tous, avec une interface complète et un éditeur ; c’est là que la plupart des utilisateurs travaillent, et que les nouveautés comme le mode Draft de juin 2026 sont mises en avant. Discord reste utilisable pour générer et pour les échanges avec la communauté. Dans les deux cas, un abonnement payant est nécessaire pour générer : il n’y a pas d’essai gratuit.
Pour trois personnes qui produisent des visuels chaque semaine, comptez entre 30 et 90 $ par mois avec Midjourney (une formule Standard à 30 $ par personne donne des images illimitées en mode lent), ou de 33 à 66 € avec Firefly (Standard ou Pro par personne). Si l’équipe a déjà ChatGPT Plus ou Google AI Pro, le coût supplémentaire peut être nul. Le vrai coût est le temps : formez l’équipe à une méthode commune avant de multiplier les abonnements.
En partie. Les outils acceptent des images de référence et, pour certains, des styles enregistrés : vous pouvez obtenir une palette, un traitement et une ambiance cohérents. Vous n’obtiendrez pas un respect strict d’un guide de marque, avec ses logos et ses règles de mise en page : cette étape reste manuelle, dans un outil de design. Le plus efficace est de documenter un « vocabulaire de style » partagé par l’équipe, puis de finaliser dans votre outil habituel.
Un choix qui dépend de l’usage, pas de l’outil, les générateurs d’images IA ont atteint un niveau où le choix de l’outil compte moins que la clarté de l’usage. Pour une illustration rapide, l’assistant que vous avez déjà ; pour un rendu soigné, Midjourney ; pour un usage commercial serein, Firefly ; pour du texte, Ideogram ; pour la confidentialité, un modèle chez vous. Ce qui ne change pas d’un outil à l’autre, c’est la méthode : décrire précisément, générer plusieurs variantes, retoucher par touches, vérifier de près et signaler l’origine IA quand l’image se veut réaliste. Les guides de cette série détaillent chaque outil ; si vous voulez que votre équipe adopte ces réflexes vite et sans risque, notre accompagnement à la production d’images IA en équipe est fait pour ça.

29 septembre 2026
Intelligence Artificielle – IA


29 septembre 2026
Intelligence Artificielle – IA


29 septembre 2026
Intelligence Artificielle – IA

Laisser un commentaire