Tu génères des images avec l'IA et tu aimerais créer un personnage qui reste identique d'une image à l'autre ? C'est le défi numéro un quand on veut raconter une histoire visuelle, créer une mascotte de marque ou produire une série de publicités. Par défaut, chaque génération produit un nouveau visage, une nouvelle coiffure, des vêtements différents. Résultat : impossible de reconnaître ton personnage. Heureusement, quatre méthodes concrètes te permettent aujourd'hui de maintenir cette cohérence visuelle sans devenir expert en IA. Cet article te montre exactement comment faire, avec les bons outils et les bonnes techniques, pour que ton personnage reste reconnaissable du premier au dernier visuel.
Comment maintenir la cohérence d'un personnage IA entre plusieurs images ?
La cohérence d'un personnage IA repose sur quatre méthodes principales : la référence de personnage (character reference), la graine fixe (seed), le prompt ultra-détaillé répété, et l'entraînement d'un modèle personnalisé. Chacune a ses avantages selon ton niveau technique et ton budget.
La référence de personnage consiste à fournir une image existante de ton personnage à l'IA, qui va ensuite s'en inspirer pour toutes les générations suivantes. Midjourney propose cette fonction avec le paramètre --cref, Leonardo AI avec Image Guidance, et Stable Diffusion via des extensions comme IP-Adapter. Tu uploades ton image de base, tu décris la nouvelle scène, et l'IA garde les traits du visage, la coiffure, les proportions.
La graine fixe (seed) est un nombre qui détermine le point de départ aléatoire de la génération. En utilisant toujours la même graine avec des prompts similaires, tu obtiens des variations autour du même personnage. Cette méthode fonctionne bien pour des poses légèrement différentes, mais dès que tu changes radicalement l'angle ou l'action, le personnage dérive.
Le prompt ultra-détaillé consiste à décrire ton personnage avec une précision chirurgicale (couleur exacte des yeux, forme du nez, style de cheveux, vêtements) et à copier-coller cette description dans chaque nouveau prompt. C'est la méthode la plus accessible mais aussi la moins fiable : l'IA interprète différemment les mots selon le contexte.
L'entraînement d'un modèle personnalisé (LoRA sur Stable Diffusion, ou Custom Model sur certaines plateformes) te permet de créer un "concept" unique à partir de 10 à 30 photos de ton personnage. Une fois entraîné, tu invoques ce concept dans tes prompts et l'IA génère automatiquement ton personnage. C'est la solution la plus robuste mais elle demande du temps et des compétences techniques.
Quelle méthode choisir selon ton projet et ton niveau ?
Choisis la référence de personnage (character reference) si tu débutes et veux des résultats rapides, la graine fixe pour des variations mineures, le prompt détaillé pour des tests gratuits, et le modèle personnalisé si tu produis des dizaines d'images du même personnage. Voici un tableau comparatif pour t'aider :
| Méthode | Niveau requis | Coût | Cohérence | Cas d'usage |
|---|---|---|---|---|
| Character reference | Débutant | Abonnement outil (10-30 €/mois) | Très bonne | Pubs, réseaux sociaux, storytelling |
| Graine fixe | Débutant | Gratuit ou abonnement | Moyenne | Tests rapides, variations légères |
| Prompt détaillé | Débutant | Gratuit possible | Faible à moyenne | Expérimentation, petits projets |
| Modèle personnalisé | Intermédiaire/avancé | 0 € (si auto-hébergé) ou 20-50 € | Excellente | Séries longues, marque, mascotte |
Si tu crées une campagne publicitaire avec plusieurs visuels mettant en scène le même protagoniste, la référence de personnage est ton meilleur allié. Tu génères une première image qui te plaît, puis tu la réutilises comme référence pour toutes les suivantes. Le programme Créer des publicités avec l'IA de Skilzy t'enseigne justement cette technique étape par étape, avec accès direct aux outils dans le Lab IA intégré, sans multiplier les abonnements.
Pour un projet personnel où tu testes différentes idées sans budget, commence par le prompt détaillé sur un outil gratuit comme Leonardo AI (150 crédits quotidiens gratuits) ou Playground AI. Note précisément les caractéristiques de ton personnage dans un document et colle cette description dans chaque génération.
Si tu produis une bande dessinée ou une série de 50+ images avec le même héros, investis dans l'entraînement d'un modèle personnalisé. Le temps passé au départ (quelques heures) sera largement rentabilisé par la cohérence parfaite obtenue ensuite.
Comment utiliser la référence de personnage sur Midjourney et Leonardo AI ?
Sur Midjourney, ajoute --cref URL_IMAGE à ton prompt ; sur Leonardo AI, active Image Guidance et uploade ton image de référence avec un poids de 0,7 à 0,9. Voici la procédure détaillée pour chaque outil.
Midjourney (via Discord)
- Génère ou uploade une première image de ton personnage qui te satisfait pleinement
- Clique droit sur l'image, "Copier le lien de l'image"
- Dans ton nouveau prompt, écris :
/imagine prompt: [ta scène] --cref [URL copiée] - Ajoute
--cw 100pour une cohérence maximale du visage (par défaut c'est 100, tu peux descendre à 50 si tu veux plus de liberté) - Exemple concret :
/imagine prompt: woman sitting in a café, drinking coffee, warm lighting --cref https://cdn.midjourney.com/abc123.png --cw 100
Midjourney va conserver les traits du visage, la coiffure, la couleur de peau. En revanche, les vêtements peuvent varier sauf si tu les décris explicitement dans le prompt. Pour une cohérence vestimentaire, ajoute "wearing blue denim jacket and white t-shirt" à chaque prompt.
Leonardo AI
- Crée ta première image ou uploade une photo de référence
- Lance une nouvelle génération
- Active le toggle "Image Guidance" dans le panneau latéral
- Clique sur "Upload Image" et sélectionne ton image de personnage
- Règle le curseur "Strength" entre 0,7 et 0,9 (plus c'est élevé, plus la cohérence est stricte)
- Écris ton prompt décrivant la nouvelle scène
- Génère
Leonardo AI offre aussi un mode "Character Reference" spécifique dans certains modèles comme Phoenix. Ce mode analyse le visage et la silhouette pour les reproduire fidèlement. Teste les deux approches pour voir laquelle donne les meilleurs résultats avec ton personnage.
Comment créer un personnage cohérent avec un prompt détaillé ?
Rédige une description de 50 à 100 mots couvrant physique, vêtements et style, puis copie-colle cette base dans chaque nouveau prompt en ajoutant uniquement la scène. Cette méthode gratuite fonctionne sur tous les générateurs d'images IA.
Voici un template de description efficace :
[Âge approximatif], [genre], [origine ethnique], [couleur et style de cheveux], [couleur des yeux], [traits distinctifs : lunettes, barbe, tatouage, etc.], [morphologie], [style vestimentaire précis], [accessoires récurrents]
Exemple concret :
25-year-old woman, caucasian, shoulder-length wavy auburn hair, green eyes, small nose piercing, athletic build, wearing oversized beige cardigan and black jeans, white sneakers, small silver hoop earrings
Ensuite, pour chaque nouvelle image, tu ajoutes simplement l'action ou la scène :
- Premier prompt : "[description complète], standing in a bookstore, browsing shelves, soft natural light"
- Deuxième prompt : "[description complète], sitting on a park bench, reading a book, autumn leaves falling"
- Troisième prompt : "[description complète], walking a golden retriever in the rain, holding red umbrella"
Cette technique donne des résultats variables. Selon l'outil et le modèle, tu obtiendras entre 60 % et 80 % de cohérence. Les traits du visage changent légèrement d'une image à l'autre, mais l'impression générale reste reconnaissable. C'est suffisant pour des projets de test ou des posts isolés sur les réseaux sociaux.
Pour améliorer la cohérence, ajoute un style artistique constant ("digital illustration", "photorealistic portrait", "anime style") et un artiste de référence ("in the style of Annie Leibovitz" pour de la photo, "Studio Ghibli style" pour de l'animation). Cela unifie le rendu visuel même si le visage varie un peu.
Comment entraîner un modèle personnalisé pour une cohérence parfaite ?
Entraîne un LoRA (Low-Rank Adaptation) sur Stable Diffusion avec 15 à 30 images de ton personnage sous différents angles, puis invoque ce LoRA dans tes prompts. C'est la méthode professionnelle pour une cohérence absolue.
Le processus complet :
Collecte des images d'entraînement : génère ou photographie 15 à 30 images de ton personnage sous différents angles (face, profil, trois-quarts), expressions (sourire, neutre, surpris) et éclairages. Évite les arrière-plans trop chargés.
Préparation des données : recadre toutes les images au même format (512x512 ou 768x768 pixels), nomme-les de façon cohérente ("character_001.png", "character_002.png", etc.).
Choix de la plateforme d'entraînement :
- Civitai : interface web simple, entraînement gratuit mais limité en crédits
- Google Colab : gratuit avec GPU, nécessite de suivre un tutoriel (cherche "Kohya LoRA training Colab")
- Replicate : payant (environ 2 à 5 € par entraînement), très simple d'utilisation
Paramètres d'entraînement : si tu utilises Kohya (le standard), règle :
- Learning rate : 0.0001
- Epochs : 10 à 20
- Batch size : 1 ou 2
- Network dimension : 32 ou 64
Test du modèle : une fois l'entraînement terminé (15 à 45 minutes selon la plateforme), télécharge le fichier .safetensors et teste-le dans Automatic1111, ComfyUI ou Fooocus avec un prompt simple : "[ton_trigger_word], standing, neutral background".
Utilisation : dans tous tes prompts futurs, invoque ton LoRA avec le mot-clé d'activation (trigger word) que tu as défini pendant l'entraînement. Exemple : "emma_character, sitting in a café, warm lighting, photorealistic".
Cette méthode demande un investissement initial en temps (compter une demi-journée la première fois, puis 1 heure pour les entraînements suivants), mais elle te donne un contrôle total. Ton personnage sera identique à 95 % d'une image à l'autre, seuls la pose et l'environnement changeront.
Si tu veux aller plus loin dans la création de visuels publicitaires avec des personnages cohérents, le programme Créer des publicités avec l'IA te montre comment combiner ces techniques avec les bonnes pratiques marketing pour des campagnes efficaces.
Quelles erreurs éviter pour garder un personnage IA cohérent ?
Les trois erreurs principales sont de changer d'outil entre les générations, de modifier trop d'éléments à la fois dans les prompts, et de ne pas documenter tes paramètres de génération. Voici comment les éviter.
Changer d'outil en cours de route
Chaque générateur d'images IA (Midjourney, DALL-E, Leonardo, Stable Diffusion) a sa propre "signature" visuelle. Un visage généré sur Midjourney aura un rendu différent sur Leonardo AI, même avec le même prompt. Si tu commences une série avec Midjourney, reste sur Midjourney. Si tu dois absolument changer d'outil, utilise ta première image comme référence dans le nouvel outil plutôt que de repartir d'un prompt.
Modifier trop d'éléments simultanément
Tu veux que ton personnage passe d'une scène en intérieur à une scène en extérieur ? Change l'environnement mais garde la description du personnage, l'éclairage général et le style artistique identiques. Sinon, l'IA interprète ces changements multiples comme une demande de nouveau personnage. Procède par petites itérations : d'abord change la pose, génère, valide. Puis change l'arrière-plan, génère, valide. Évite de tout modifier d'un coup.
Ne pas documenter tes paramètres
Tu as généré l'image parfaite de ton personnage il y a trois jours, et tu ne retrouves plus le prompt exact, ni la graine, ni les paramètres ? C'est la frustration garantie. Crée un document (Google Doc, Notion, simple fichier texte) où tu notes systématiquement :
- Le prompt complet
- La graine (seed) si tu l'as fixée
- L'outil utilisé et le modèle (ex : "Midjourney v6", "Leonardo Phoenix")
- Les paramètres spécifiques (--cw, aspect ratio, style preset)
- L'URL ou le fichier de l'image générée
Cette documentation te permet de reproduire exactement le même personnage plusieurs semaines après, ou de transmettre le projet à quelqu'un d'autre. C'est particulièrement utile si tu travailles en équipe ou si tu sous-traites une partie de la production visuelle.
Enfin, ne néglige pas la phase de test. Génère 5 à 10 images de ton personnage dans des contextes variés avant de lancer la production complète. Tu verras immédiatement si ta méthode tient la route ou si le personnage dérive trop. Mieux vaut ajuster au début que refaire 50 images plus tard.
Conclusion
Garder un personnage IA cohérent sur toutes tes images n'est plus un casse-tête si tu appliques la bonne méthode. La référence de personnage (character reference) offre le meilleur rapport simplicité-efficacité pour la plupart des projets. Le modèle personnalisé (LoRA) te donne une cohérence parfaite si tu produis en série. Le prompt détaillé reste une option gratuite pour débuter. Documente tes paramètres, teste avant de produire en masse, et reste sur le même outil pour une série donnée. Avec ces règles simples, tu crées des séries visuelles professionnelles où ton personnage reste reconnaissable du premier au dernier visuel.