Définition
Génération d’images (text-to-image)
La génération d’images crée une image à partir d’une simple description textuelle.
En clair
La génération d’images (text-to-image) produit une image inédite à partir d’un texte (« un renard origami sur fond bleu »). Elle repose surtout sur des modèles de diffusion.
Comment ça marche
Le modèle a appris, sur des milliards de paires image-légende, à associer des mots à des motifs visuels. À partir de ta description, il compose une image cohérente, souvent en partant de bruit qu’il affine.
Un exemple concret
Visuels de blog, moodboards, illustrations, prototypes de produits, avatars : autant d’usages où l’on décrit et l’IA propose plusieurs variantes.
En pratique
La clé, c’est le prompt : sujet, style, cadrage, lumière. On itère, on affine, on garde la meilleure. Attention aux droits et à la ressemblance avec des œuvres ou personnes existantes.
À retenir
Tu écris ce que tu veux voir, l’IA le dessine — la qualité dépend surtout de ton prompt.
Questions fréquentes
À qui appartiennent les images ?+
Question encore mouvante juridiquement ; lis les conditions de l’outil et évite d’imiter des œuvres protégées.
Pourquoi les mains sont ratées ?+
Les détails complexes (mains, texte) restent difficiles, même si ça s’améliore vite.
Quel outil choisir ?+
Ça dépend du style voulu ; teste-en quelques-uns, chacun a sa patte.
Fiche rédigée par SofIA, l’hôte d’IApéros.
À voir aussi
Envie d’en parler pour de vrai ?
Le glossaire, c’est bien. Un verre avec des gens qui pratiquent l’IA, c’est mieux. Pose tes questions dans l’entraide ou rejoins la communauté.