Kostümkonsistenz
Aktualisiert 20. September 2026

Der Instinkt sagt, man solle die Kleidung in jeder Einstellung beschreiben. Das ist falsch – und teuer: Ein Absatz über Kleidung in einem Shot-Prompt konkurriert mit dem Gesicht um die Aufmerksamkeit des Modells und zieht in einem Hochformat die Kamera so weit zurück, dass der Kopf schrumpft und die Identität verloren geht. Ein heller Mantel, der siebzig Prozent des Bildes ausfüllt, mit einem winzigen Gesicht darüber, ist ein echtes Fehlermuster, keine Hypothese.
Deshalb liegt die Kleidung auf dem Referenzblatt der Figur, und Einstellungen verweisen auf die Person, statt das Outfit neu zu beschreiben. Was das Blatt festlegt, erbt jede Einstellung.
| Das Referenzblatt | Ein Outfit, beschrieben in sachlichen Begriffen – Schnitt, Stoff, Verarbeitung, Verschluss – und als Casting-Foto auf Weiß gerendert. |
|---|---|
| Die Kostümachse | Ein projektweites Register (Epoche, Schneidertradition, Stoff und Handwerk), das einmal bei der Analyse eingebracht wird, sodass die gesamte Besetzung in einer Welt gekleidet ist. |
| Ein zweites Outfit | Wird zu einem eigenen Referenzbild – ein Zustand der Figur, kein Satz in einer Einstellung. |
| Kleine Veränderungen | Regen, Staub, ein gelöster Kragen, etwas in der Hand: als Text in der Einstellung geschrieben. Kein zweites Bild nötig. |
| Shot-Prompts | Verweisen auf die Figur. Sie listen die Kleidung nicht erneut auf und ziehen nicht zurück, um sie zu zeigen. |
Diese Unterscheidung entscheidet darüber, ob du ein zweites Bild brauchst, und sie ergibt sich aus dem Verhalten referenzbasierter Videomodelle: Sie kopieren das, was im Bild ist – Gesicht, Kleidung, Accessoires, Struktur – fast wortgetreu, und akzeptieren als Text alles, was als globaler Effekt über dem Bild liegt – Wetter, Tageszeit, Licht, Schmutz.
Diese Grenze in Richtung zu vieler Bilder falsch zu ziehen, ist der häufige Fehler: Anfangs waren die meisten automatisch erkannten „Zustände“ Dinge wie das Halten einer Tasse oder eine brennende Lampe. Das ist Text. Die Pipeline begrenzt jetzt, wie viele Zustände sie pro Figur vorschlägt, genau weil das Übererzeugen Geld kostet und nichts bringt.
In Drehbüchern wird die Kleidung einer Figur oft als Bogen geschrieben – frühe Episoden in einem Outfit, spätere in einem anderen, plus ein Hochzeitslook. Wenn das Modell alle drei als eine einzige Beschreibung erhält, zeichnet es eine Figur, die von jedem die Hälfte trägt. Deshalb wird die Beschreibung strukturell aufgeteilt, bevor irgendein Bild generiert wird: Das erste Outfit bleibt auf dem Basisblatt, der Rest wird zu separaten Zustandsbildern. Teilbezeichnungen (Schuhwerk, Accessoires, Stoff) werden als Teile eines Outfits erkannt, nicht als zweites Outfit.
Pro Einstellung gilt folgende Priorität: ein für dieses spezifische Segment gewählter Zustand, dann ein Episoden-Override-Bild, dann ein für diese Episode zugewiesener Zustand, dann das Basisblatt. Nur tatsächlich gerenderte Zustände zählen – existiert ein Zustand nur auf dem Papier, aber ohne Bild, fällt die Einstellung auf das Basisblatt zurück und übernimmt die Abweichung als Text, sodass die Veränderung auch ohne Bild beschrieben wird.
Die Zuweisung erfolgt automatisch: Nach Generierung der Shot-List legt ein Durchgang fest, welche Segmente welchen Zustand verwenden, und hält das fest. Das passiert absichtlich pro Segment statt pro Episode – ein Flashback-Outfit, das auf eine ganze Episode angewendet wird, würde die Figur in jeder Einstellung falsch kleiden.
Jedes Zustandsbild ist ein generiertes Bild: 7 Credits. Dein erstes Projekt enthält 15 kostenlose Referenzbilder für Figuren, Schauplätze und Requisiten, und Zustandsbilder haben in diesem ersten Projekt eine eigene separate Freimenge – das Ausprobieren kostet also nichts. Rein textliche Änderungen kosten überhaupt nichts, was der Hauptgrund ist, warum sich die Grenze zwischen Zustand und Satz zu lernen lohnt. Unter Charakterbögen erfährst du, wie das Basisbild aufgebaut wird, und auf der Preisseite findest du die Tarife.
Sprachen
Jede Serie unten wurde mit derselben Pipeline produziert, wobei die Darsteller die jeweilige Sprache auf muttersprachlichem Niveau sprechen: Oberfläche, Arbeitsdokumente und gesprochene Zeilen sind in einer Sprache, nichts ist synchronisiert. Öffne eine Serie, um es dir anzuhören.
A Carta de LisboaPortuguêsMuttersprachliche Dialoge
윈터 프라미스한국어Muttersprachliche Dialoge
El Secreto de CostaEspañolMuttersprachliche Dialoge
浪人の誓い日本語Muttersprachliche Dialoge
Ikrar JakartaBahasa IndonesiaMuttersprachliche Dialoge
Зимняя коронаРусскийMuttersprachliche Dialoge
L’Héritier du DéfiléFrançaisMuttersprachliche Dialoge
Il Tavolo dell'OlivaItalianoMuttersprachliche Dialoge
De Vuurtoren van de FjordNederlandsMuttersprachliche Dialoge
العهد الصحراويالعربيةMuttersprachliche Dialoge
Çantasındaki SözleşmeTürkçeMuttersprachliche Dialoge
Die Istanbul-TäuschungDeutschIn deiner Sprache
Останній сигналУкраїнськаMuttersprachliche Dialoge
問劍青雲繁體中文Muttersprachliche Dialoge
The Last EnvelopeEnglishMuttersprachliche DialogeWeil eine erneute Beschreibung mit dem Gesicht um Aufmerksamkeit konkurriert und die Kamera zurückdrängt, um die Kleidung zu zeigen, sodass der Kopf schrumpft und die Figur unkenntlich wird. Kleidung wird einmal auf dem Referenzblatt festgelegt und von jeder Einstellung übernommen, die auf diese Figur verweist.
Wenn sich das Kleidungsstück selbst ändert – ein kompletter Outfit-Wechsel, Rüstung, eine Uniform, etwas Verbranntes oder bis zur Unkenntlichkeit Zerrissenes. Wenn dasselbe Kleidungsstück nur nass, staubig, blutbefleckt oder aufgeknöpft ist, schreibe das in den Shot-Text; referenzbasierte Modelle akzeptieren das als über das Bild gelegte Effekte.
Die Beschreibung wird aufgeteilt, bevor etwas gezeichnet wird: Das erste Outfit bleibt auf dem Basisblatt, die späteren werden zu eigenen Zustandsbildern. Wenn man alle auf einmal übergibt, zeichnet ein einziger Render eine Figur, die Teile von jedem trägt.
Ein für dieses Segment gewählter Zustand gewinnt, dann eine pro Episode festgelegte Überschreibung, dann ein der Episode zugewiesener Zustand, dann das Basisblatt. Zustände ohne gerendertes Bild zählen nicht – der Shot verwendet das Basisblatt und beschreibt den Unterschied in Worten.
Nein. Die Garderobe ist bei der Generierung des Shots festgelegt, also bedeutet eine Änderung, dass dieses Segment erneut zum üblichen Preis pro Sekunde generiert werden muss.
Fünfzehn kostenlose Referenzbilder reichen für eine ganze kleine Besetzung.
SceneMixer kostenlos testenCredit-Pakete ab $1.49 · Pro $7.99/Monat · Keine Kreditkarte zum Start nötig
Preise·Anleitungen·Beispiele·Support·Datenschutz·AGB·Rechtliches·Kontakt·© 2026 SceneMixer