Aller au contenu
GenLovers

Guide de prompts Seedream 4.5 : les structures qui tiennent

Dernière mise à jour: 8 min de lectureDifficulté: Accessible aux débutants

Écrit par Clement

Une carte pour le guide de prompts Seedream 4.5, montrant quatre barres empilées intitulées « subject », « style », « detail » et « constraint ».

La plupart des prompts Seedream 4.5 échouent de la même façon : ils décrivent une scène alors que le modèle attendait une consigne, ou ils donnent une consigne si vague que le modèle doit deviner. La solution n'est pas la créativité, c'est la structure, et elle s'apprend en une séance.

Ce guide est le complément « rédaction de prompts » de notre pas-à-pas Seedream 4.5. Celui-ci couvre le workflow et les réglages ; celui-là va au fond des mots : comment empiler un prompt texte vers image en couches, comment formuler une édition pour que le modèle change une seule chose et préserve le reste, et comment diriger une fusion multi-images pour que chaque image d'entrée apporte ce que vous aviez prévu.

Illustration
A Seedream 4.5 prompt assembles in layers: subject and pose, then style and palette, then setting and lighting, then (only if needed) camera framing. Edits flip the shape: name the change, pin what survives.

La règle qui gouverne tout prompt d'édition

Seedream 4.5 traite votre image d'entrée comme la base et votre prompt comme la différence. Ce seul fait décide de la façon d'écrire. Nommez ce qui change. Ne décrivez ce qui reste identique que si cela ne va pas de soi. Dès que vous redécrivez toute la scène, vous invitez le modèle à régénérer des éléments que vous vouliez intacts.

Nous l'avons testé directement, édition contre redescription, et l'écart n'était pas subtil : « keep the product, change only the background » (gardez le produit, changez seulement l'arrière-plan) a préservé la source bien mieux qu'une nouvelle description de la même scène. La version redécrite paraissait plausible isolément. À côté de la source, le produit avait dérivé.

La structure en couches pour le texte vers image

Sans image d'entrée, construisez le prompt en couches, dans cet ordre : le sujet et la pose d'abord, puis le style et la palette de couleurs, puis le décor et la lumière, puis le cadrage caméra. L'ordre compte parce qu'il suit ce que le modèle pèse le plus. Une indication de caméra placée en tête coûte de la fidélité sur le sujet en fin de prompt.

Voici le même prompt construit couche par couche. Sujet : "a woman in her 30s mid-laugh, head tilted back" (une femme d'une trentaine d'années en plein rire, la tête renversée). Style : "shot like a premium lifestyle editorial, warm muted palette" (photographié comme un éditorial lifestyle haut de gamme, palette chaude et sourde). Décor : "in a sunlit kitchen, late afternoon light through the window" (dans une cuisine ensoleillée, lumière de fin d'après-midi par la fenêtre). Caméra : "waist-up framing, shallow depth of field" (cadrage à la taille, faible profondeur de champ). Chaque couche resserre l'espace sans heurter la précédente.

Gardez un seul point focal. Si vous voulez un texte lisible ou un visage net dans l'image, dites-le clairement et laissez-lui de la place. Les points focaux concurrents sont l'endroit où le rendu du texte et des visages, pourtant réputé sur ce modèle, commence à vaciller.

Construire un prompt d'édition en quatre passes

Pour l'image vers image, écrivez le prompt dans cet ordre. Cela prend trente secondes et évite des tours entiers de régénération.

  1. 1

    Nommer le changement unique

    Commencez par le verbe et la cible : "replace the background with...", "change the outfit to...", "restyle the lighting as...". Une seule modification par tour vaut mieux que trois modifications empilées qui se contredisent.

  2. 2

    Fixer ce qui doit survivre

    Ajoutez la clause de préservation uniquement pour ce qui est menacé et pas évident : "keep the product, its label, and the lighting exactly as shown." Inutile de tout lister. Listez ce que la modification pourrait raisonnablement perturber.

  3. 3

    Citer tout texte exact

    Si une étiquette, une enseigne ou un titre doit se lire d'une façon précise, citez la chaîne exacte dans le prompt. Un texte paraphrasé est la source la plus fréquente de lettres déformées. Les chaînes citées sont ce que ce modèle réussit exceptionnellement bien.

  4. 4

    Vérifier la cohérence, pas seulement la qualité

    Quand le résultat arrive, comparez d'abord les éléments à préserver avec la source avant d'admirer les nouveaux. Un résultat net et soigné peut malgré tout avoir dérivé en silence de l'original. La cohérence est ce pour quoi ce modèle est réglé : exigez-la.

Modèles prêts à copier

Des modèles pour les cas les plus courants. Remplacez les parties entre crochets, gardez la forme. Les modèles de prompt restent en anglais pour que vous puissiez les copier tels quels.

Changement d'arrière-plan
"Replace the background with [new setting]. Keep the [subject], its [key detail], and the lighting exactly as shown."
Changement de tenue
"Change the outfit to [new outfit]. Keep the face, pose, and framing unchanged."
Transfert de style
"Restyle this image as [style]. Preserve the composition and the subject's identity."
Fusion de deux images
"Use the person from image 1 and the jacket from image 2. Place the person in [setting], wearing the jacket, lit by [lighting]."
Texte dans l'image
"A [surface] that reads \"[exact string]\" in [style of lettering]. Make the text the focal point."

Recevez les nouveaux fichiers de prompts en premier

Un email quand un nouveau fichier de prompts testé ou un guide de modèle est publié. Des prompts éprouvés en production, pas de théorie. Pas de spam, désinscription à tout moment.

Diriger une fusion multi-images

Indiquez explicitement l'apport de chaque entrée : quelle image fournit le sujet, laquelle fournit un accessoire ou un style, et comment ils s'agencent dans la nouvelle composition. Le modèle répond à des consignes précises et en couches, et la fusion est le cas où cette discipline rapporte le plus.

Peu d'images propres valent mieux que beaucoup d'images moyennes. Deux ou trois images nettes qui possèdent chacune un élément fusionnent plus sûrement qu'un tas où plusieurs n'apportent presque rien. Gardez aussi un éclairage raisonnablement homogène entre les entrées : une photo de studio plus une photo de téléphone sombre obligent le modèle à concilier deux qualités de matière, et c'est là que les fusions ont l'air assemblées au lieu d'être photographiées comme une seule scène.

Quand un élément de la fusion paraît faux et que le reste est bon, ne réécrivez pas tout le prompt. Vérifiez d'abord l'image source de cet élément, puis précisez uniquement la consigne qui s'y rapporte.

Deux personnages distincts dans un même cadre

Demander deux personnages précis dans une seule image est un problème différent de la fusion, et il échoue de façon caractéristique : le modèle les moyenne. Vous demandez deux personnes et obtenez deux fois le même visage, ou un duo qui partage une couleur de cheveux appartenant à un seul. Le nom technique est attribute bleed (contamination d'attributs), et il survient parce que le modèle garde les deux descriptions dans le même budget d'attention sans raison forte de les séparer.

La solution est de lui donner cette raison. Ancrez chaque personnage à une position distincte du cadre et décrivez-le comme un ensemble, plutôt que de lister tous les traits des deux en espérant qu'ils atterrissent sur le bon sujet. "On the left, a tall woman with short black hair in a red jacket; on the right, a shorter man with blond curls in a grey coat" (à gauche, une grande femme aux cheveux noirs courts en veste rouge ; à droite, un homme plus petit aux boucles blondes en manteau gris) donne au modèle deux emplacements spatiaux à remplir séparément. La même description écrite en liste plate de cinq traits lui donne un seul tas mélangé.

Les LoRA de personnage compliquent la chose au lieu de l'aider. Charger deux LoRA de personnage à la fois est le moyen le plus sûr d'obtenir un mélange des deux, car chacune tire toute l'image vers son propre sujet. Si vous avez besoin de deux personnages entraînés précis ensemble, les générer séparément puis les composer demande généralement moins de travail que de lutter contre la fusion.

La qualité de la LoRA elle-même compte ici plus que la plupart des gens ne le pensent. Une LoRA de mauvaise qualité ne rend pas seulement son sujet moins bien : elle dégrade activement la capacité du modèle à suivre le reste du prompt. Les détails des deux personnages se mélangent, et des consignes normalement suivies proprement se mettent à produire des erreurs. Une LoRA bien entraînée tient son sujet et laisse le reste du prompt se comporter normalement ; une LoRA faible déborde sur tout ce qui l'entoure.

Quand le prompt n'est pas le problème

Un résultat flou ou pauvre en détails sur une édition remonte généralement à l'image d'entrée, pas à la formulation. Le modèle sait affiner et restyler, mais il ne peut pas inventer un détail qui n'existe nulle part dans la source. Avant de réécrire un prompt pour la quatrième fois, regardez de près ce que vous lui avez donné.

C'est pareil pour les visages en fusion : si le visage source est petit, flou ou à moitié tourné, aucune formulation ne le sauve. Remplacez l'entrée par une image plus propre et le « problème de prompt » tend à disparaître.

Questions fréquentes

Comment générer deux personnages différents dans une même image ?
Donnez à chaque personnage sa propre position dans le cadre et décrivez-le comme un ensemble, plutôt que de lister tous les traits des deux d'un coup : "on the left, a tall woman with short black hair; on the right, a shorter man with blond curls". Une liste plate de traits invite à la contamination d'attributs : le modèle moyenne les deux en un seul look ou leur prête les traits de l'autre. Deux LoRA de personnage chargées ensemble aggravent le mélange. Pour deux personnages entraînés précis, il est donc généralement plus rapide de les générer séparément puis de composer le résultat.
À quoi ressemble un bon prompt Seedream 4.5 ?
Pour le texte vers image : en couches, dans l'ordre : sujet et pose, style et palette, décor et lumière, cadrage caméra. Pour les éditions : une consigne qui nomme le changement unique, plus une courte clause de préservation pour tout ce qui est menacé. Les deux formes sont courtes. La précision l'emporte sur la longueur.
Comment éditer une image sans que Seedream change tout ?
Écrivez la différence, pas la scène : "change only the background to a beach at sunset, keep the product and lighting as shown." Redécrire toute la scène est la première cause de dérive indésirable.
Seedream 4.5 sait-il rendre un texte exact ?
Oui, et exceptionnellement bien, mais seulement si vous citez la chaîne exacte dans le prompt et qu'elle reste un point focal net. Paraphraser le texte ou le noyer parmi des sujets concurrents produit des lettres déformées.
Combien d'images d'entrée utiliser pour une fusion ?
Deux ou trois images nettes, chacune apportant un élément. Plus d'entrées n'ajoutent pas de contrôle : elles le diluent. La qualité et la clarté de chaque source comptent plus que leur nombre.

Continuer la lecture

Modèles liés

Recevez les nouveaux fichiers de prompts en premier

Un email quand un nouveau fichier de prompts testé ou un guide de modèle est publié. Des prompts éprouvés en production, pas de théorie. Pas de spam, désinscription à tout moment.

Ajouter GenLovers comme source préférée sur Google