Cohérence des costumes
Mis à jour le 20 septembre 2026

Le réflexe est de décrire les vêtements dans chaque plan. C’est une erreur, et elle coûte cher : un paragraphe sur la tenue dans un prompt de plan rivalise avec le visage pour capter l’attention du modèle, et dans un cadre vertical, cela fait reculer la caméra suffisamment pour réduire la tête jusqu’à faire disparaître l’identité du personnage. Un manteau pâle qui remplit soixante-dix pour cent du cadre avec un minuscule visage au sommet est un échec réel, pas une hypothèse.
Les vêtements figurent donc sur la fiche de référence du personnage, et les plans désignent la personne au lieu de redécrire sa tenue. Ce que la fiche établit, chaque plan le reprend.
| La fiche de référence | Une seule tenue, décrite en termes concrets — coupe, tissu, construction, fermeture — et rendue sous forme de photo de casting sur fond blanc. |
|---|---|
| L’axe costume | Un registre au niveau du projet (époque, tradition tailleur, tissu et artisanat) injecté une fois pendant l’analyse, afin que toute la distribution soit habillée dans le même univers. |
| Une deuxième tenue | Devient sa propre image de référence — un état du personnage, pas une phrase dans un plan. |
| Petits changements | Pluie, poussière, col desserré, objet tenu : s’écrivent en texte dans le plan. Pas besoin d’une deuxième image. |
| Prompts de plan | Ils désignent le personnage. Ils ne redressent pas la liste des vêtements et ne font pas reculer la caméra pour les montrer. |
C’est cette distinction qui détermine si vous avez besoin d’une deuxième image, et elle vient du comportement des modèles vidéo conditionnés par référence : ils copient presque à l’identique ce qui se trouve dans l’image — visage, vêtements, accessoires, structure — et acceptent sous forme de texte tout ce qui se superpose à l’image comme effet global : météo, heure de la journée, lumière, saleté.
Se tromper de frontière en créant trop d’images est l’erreur la plus courante : au début, la plupart des « états » détectés automatiquement correspondaient à des choses comme tenir une tasse ou une lampe allumée. Ce sont des éléments textuels. Le pipeline limite désormais le nombre d’états proposés par personnage précisément parce qu’en générer trop coûte de l’argent sans rien apporter.
Les scripts décrivent souvent la garde-robe d’un personnage comme une trajectoire : premiers épisodes dans une tenue, plus tard dans une autre, plus une tenue de mariage. Si vous donnez ces trois éléments en une seule description, le rendu dessine une figure qui porte la moitié de chaque tenue. La description est donc divisée structurellement avant toute génération d’image : la première tenue reste sur la fiche de base, et les autres deviennent des images d’état distinctes. Les étiquettes de parties (chaussures, accessoires, tissu) sont reconnues comme des éléments d’une même tenue, pas comme une deuxième tenue.
Pour chaque plan, par ordre de priorité : un état choisi pour ce segment précis, puis une image de remplacement par épisode, puis un état assigné à cet épisode, puis la fiche de base. Seuls les états réellement rendus comptent — si un état existe sur le papier mais n’a pas d’image, le plan revient à la fiche de base et reporte la différence sous forme de texte, afin que le changement soit tout de même décrit même sans image.
L’attribution est automatique : après génération de la liste des plans, une passe détermine quels segments utilisent quel état et le note. Cela se fait par segment et non par épisode, exprès — une tenue de flashback appliquée à un épisode entier mettrait le personnage dans de mauvais vêtements pour tous les plans de cet épisode.
Chaque image d’état est une image générée : 7 credits. Votre premier projet inclut 15 images de référence gratuites pour les personnages, lieux et accessoires, et les images d’état disposent de leur propre quota gratuit dans ce premier projet — en essayer une ne coûte donc rien. Les changements textuels seuls ne coûtent rien, ce qui est la raison principale pour laquelle il vaut la peine de maîtriser la frontière entre état et phrase. Voir fiches personnage pour la construction de l’image de base, et la page de tarification pour les tarifs.
Langues
Chaque série ci-dessous a été produite par le même pipeline, avec des personnages parlant la langue de manière native : l'interface, les documents de travail et les répliques sont tous dans la même langue, et rien n'est doublé. Ouvrez-en une pour écouter.
A Carta de LisboaPortuguêsDialogues natifs
윈터 프라미스한국어Dialogues natifs
El Secreto de CostaEspañolDialogues natifs
浪人の誓い日本語Dialogues natifs
Ikrar JakartaBahasa IndonesiaDialogues natifs
Зимняя коронаРусскийDialogues natifs
L’Héritier du DéfiléFrançaisDans votre langue
Il Tavolo dell'OlivaItalianoDialogues natifs
De Vuurtoren van de FjordNederlandsDialogues natifs
العهد الصحراويالعربيةDialogues natifs
Çantasındaki SözleşmeTürkçeDialogues natifs
Die Istanbul-TäuschungDeutschDialogues natifs
Останній сигналУкраїнськаDialogues natifs
問劍青雲繁體中文Dialogues natifs
The Last EnvelopeEnglishDialogues natifsParce que la redécrire rivalise avec le visage pour capter l’attention et pousse la caméra à reculer pour montrer les vêtements, ce qui réduit la tête jusqu’à rendre le personnage méconnaissable. La garde-robe est établie une fois sur la fiche de référence et reprise dans chaque plan qui mentionne ce personnage.
Quand le vêtement lui-même change : changement complet de tenue, armure, uniforme, vêtement brûlé ou déchiré au point d’être méconnaissable. Si le même vêtement est simplement mouillé, poussiéreux, taché de sang ou déboutonné, indiquez-le dans le texte du plan ; les modèles à référence conditionnée acceptent ces détails comme des effets superposés à l’image.
La description est séparée avant toute génération d’image : la première tenue reste sur la fiche de base, et les tenues suivantes deviennent leurs propres images d’état. Si vous fournissez toutes ces images en même temps, un seul rendu dessinera un personnage portant des éléments de chaque tenue.
C’est d’abord l’état choisi pour ce segment qui prime, puis une surcharge par épisode, puis un état attribué à l’épisode, puis la fiche de base. Les états qui n’ont pas d’image rendue ne comptent pas : le plan utilise la fiche de base et décrit la différence par du texte.
Non. La garde-robe est fixée au moment de la génération du plan, donc un changement implique de regénérer ce segment au tarif habituel par seconde.
Quinze images de référence gratuites, c’est suffisant pour toute une petite distribution.
Essayer SceneMixer gratuitementForfaits de crédits à partir de $1.49 · Pro $7.99/mois · Aucune carte bancaire requise pour commencer
Tarifs·Guides·Exemples·Assistance·Confidentialité·Conditions·Mentions légales·Contact·© 2026 SceneMixer