Corriger les mains, le texte et les petits détails des images IA
Pourquoi l'IA rate encore mains, lettres et petits objets, quoi changer dans le prompt, et quand relancer le rendu ou passer par un modèle d'édition.

L'image est presque parfaite. La lumière est bonne, la composition fonctionne, puis vous remarquez le sixième doigt, ou l'enseigne de boutique qui ressemble à une dictée ratée. Les petits détails sont l'endroit où les modèles d'image trébuchent encore, et aussi celui où une image finit à la corbeille. La plupart de ces ratés ont une cause connue et une solution peu coûteuse, alors voici une liste de dépannage plutôt qu'un cours théorique.
Pourquoi les petites choses tournent mal
Un modèle d'image ne compte pas les doigts et n'épelle pas les mots. Il peint une texture qui ressemble à des mains et à des lettres, à une échelle où quelques pixels décident si un pouce est bien un pouce. Les modèles les plus récents du catalogue s'en sortent bien mieux qu'il y a un an, mais la règle tient toujours : plus un détail est petit dans le cadre, plus il risque d'être faux. Chaque solution ci-dessous est une façon de rendre le détail plus grand, plus simple ou moins important.
Les mains : donnez-leur moins à faire
- Nommez la pose. « Mains posées sur une table » ou « tenant une tasse de café à deux mains » est une pose que le modèle a vue des milliers de fois. « Gesticulant de façon expressive » invite les doigts à n'en faire qu'à leur tête.
- Des mains grandes, ou hors champ. Un cadrage serré où les mains occupent une partie de l'image se rend mieux que des mains minuscules au bord d'un plan large. Si les mains n'ont pas d'importance, sortez-les du cadre : « cadré à partir de la poitrine ».
- Évitez les enchevêtrements. Doigts entrelacés, deux personnes qui se tiennent la main, une main qui serre un objet fin : ce sont les cas les plus difficiles. Simplifiez à une main, un objet.
- Regardez avant de corriger. Sur beaucoup de rendus, les mains sont correctes. Vérifiez en taille réelle avant de dépenser quoi que ce soit pour une correction.
Portrait en gros plan d'un potier à son tour, les deux mains façonnant de l'argile humide, mains grandes dans le cadre, douce lumière de fenêtre venant de la gauche, faible profondeur de champLe texte : court, entre guillemets et grand
Le lettrage est le détail sur lequel les modèles ont le plus progressé, et pourtant celui qu'il faut traiter avec soin. Trois règles couvrent l'essentiel :
- Mettez les mots exacts entre guillemets : une enseigne où l'on lit « OUVERT TARD ». Les guillemets indiquent au modèle que ce sont les lettres, pas une description.
- Tenez-vous à un à quatre mots. Un titre se rend bien ; un paragraphe devient un bruit en forme de lettres.
- Donnez au texte une surface et une taille : « grandes lettres blanches peintes sur un mur de briques » vaut mieux que « avec du texte ».
Si les mots comptent dans le résultat final (le titre d'une affiche, un prix, un nom de marque), la réponse honnête consiste souvent à rendre l'image avec un espace libre pour le texte, puis à poser vous-même le lettrage dans un outil de mise en page. C'est plus net, l'orthographe est juste, et vous pouvez le modifier sans relancer de rendu.
Petits objets et quantités
Les modèles ne sont pas fiables avec les nombres exacts ni avec beaucoup de petites choses qui se touchent. « Exactement trois bougies » peut revenir avec deux ou cinq ; une table pleine de couverts peut fondre en une seule forme argentée. Demandez moins d'éléments, plus grands, et décrivez leur disposition : « trois bougies alignées sur le côté gauche de la table » donne au nombre un endroit où exister.
Relancer ou éditer ?
Quand un détail est raté, vous avez deux options, et la moins chère dépend de la qualité du reste de l'image.
- Relancez quand l'image dans son ensemble est seulement correcte. Le même prompt donne une nouvelle image, et la prochaine main sera peut-être parfaite. Faire vos brouillons sur Still Lite, à partir de €0.30, garde les relances bon marché.
- Éditez quand l'image est réussie et qu'un seul détail cloche. Plusieurs modèles du catalogue prennent votre image en entrée et suivent une consigne comme « corrige la main gauche pour qu'elle ait cinq doigts, ne change rien d'autre ». Cherchez les modèles image vers image sur la page des modèles ; le prix s'affiche dans le formulaire de génération avant le lancement.
Ce que le studio n'a pas, c'est un pinceau pour masquer une zone à la main. Un modèle d'édition décide quoi changer à partir de vos mots : gardez donc une consigne courte et dites ce qui doit rester identique. S'il continue à toucher au reste de l'image, relancez plutôt.
Une liste rapide avant le rendu
- Les mains font-elles quelque chose de courant et simple, et sont-elles assez grandes pour bien se rendre ?
- Chaque texte est-il entre guillemets et fait-il quatre mots ou moins ?
- Ai-je demandé un nombre exact de petites choses ? Pourraient-elles être moins nombreuses et plus grandes ?
- Vaudrait-il mieux poser le texte moi-même ensuite plutôt que de le demander au modèle ?
La structure du prompt compte autant que ces corrections ; le guide pour rédiger des prompts d'image explique ce qui va où. Pour un personnage qui doit rester le même sur plusieurs images, les images de référence font plus que n'importe quelle formulation. Quand vous êtes prêt, ouvrez le studio et essayez la liste sur votre prochaine image.
Questions
Pourquoi l'IA rate-t-elle les mains ?
Les mains sont petites, ont beaucoup d'articulations et prennent des milliers de poses, et le modèle les peint comme une texture au lieu de compter les doigts. Des poses simples et des mains grandes dans le cadre se rendent bien mieux.
Les modèles d'image IA savent-ils écrire un texte lisible ?
Les modèles récents gèrent bien les textes courts. Mettez les mots entre guillemets, quatre au maximum, et pour tout ce qui est important, laissez de la place et posez le texte vous-même ensuite.
Faut-il relancer ou éditer une image qui a un seul mauvais détail ?
Relancez si le reste de l'image est seulement moyen. Si elle est réussie à un détail près, envoyez-la à un modèle image vers image avec une consigne courte qui dit quoi corriger et quoi garder.

