KI-Shotlist-Generator
Aktualisiert 20. September 2026

Die meisten KI-Shotlist-Tools geben dir eine Tabelle zurück. Du musst dann immer noch jeden Shot darin in einem anderen Tool erstellen und hoffen, dass das Ergebnis dem entspricht, was in der Tabelle stand. Hier ist die Shotlist der Input: Jedes Segment wird aus seinem eigenen Text generiert, bezogen auf die Referenzbilder für die Figuren und Orte, die dieser Text nennt. Ändere eine Zeile in der Liste, und nur dieses Segment wird neu gerendert. Dieser eine Unterschied bestimmt alles Weitere auf dieser Seite – die Liste muss präzise genug sein, um ausgeführt zu werden, nicht nur lesbar.
Die Einheit ist ein Segment von 4–15 Sekunden, das auch genau einer Generierung entspricht. Darin befinden sich die einzelnen Shots. Jedes Segment beginnt mit einem Header, der die Fakten festlegt, die eine Kamera vor dem Dreh braucht:
| Ort | Ein Verweis auf einen Ort in der Asset-Bibliothek des Projekts, keine neue Beschreibung – damit zwei Segmente im selben Raum auch wirklich im selben Raum spielen. |
|---|---|
| Uhrzeit und Wetter | Wird einmal pro Segment angegeben. Die Beleuchtung wird daraus und aus dem eigenen Hintergrundbild des Ortes abgeleitet, statt für jeden Shot neu erfunden zu werden. |
| Szenenbild und Requisiten | Was im Raum steht und welche Requisiten im Spiel sind. Die hier aufgeführten Requisiten sind diejenigen, deren Referenzbilder mit dem Segment mitgegeben werden. |
| Zustand des Anfangsbilds | Das erste Bild, als Standbild beschrieben: Einstellungsgröße, wer darin zu sehen ist, welche Haltung die Person hat. Alles, was in diesem ersten Bild nicht sichtbar ist, gehört hier nicht hin. |
| Personen im Hintergrund | Nur vorhanden, wenn die Szene wirklich eine Menschenmenge zeigt. Wird einmal im Header deklariert, damit sie zwischen Shots desselben Ortes nicht ein- und ausblendet. |
Das sind keine Stilvorlieben. Jede Regel wurde hinzugefügt, nachdem wir zweimal gesehen haben, dass generiertes Material auf dieselbe Weise kaputt war.
Nachdem das Modell eine Liste erstellt hat, wird vor dem Speichern ein Durchgang mit deterministischen Korrekturen darüber ausgeführt: Shotdauern werden mit dem Segment abgeglichen, die Einstellungsgröße des Anfangsbilds an Shot eins angepasst, Münder von nicht sprechenden Personen geschlossen, Waffen- und Kontaktangaben konkretisiert, übrig gebliebene Entwurfsnotizen entfernt. Ein zweiter Durchgang bittet dasselbe Modell, nur die konkreten Zeilen umzuschreiben, die eine Prüfung nicht bestanden haben – nie die ganze Liste.
Über alle Projekte auf dieser Plattform hinweg hat eine mediane Episode sieben Segmente, und ein medianes Segment ist vierzehn Sekunden lang – die Shotlist einer typischen Episode umfasst also etwa hundert Sekunden Bildschirmzeit, mit so vielen einzelnen Shots, wie diese sieben Segmente brauchen. Die Generierung der Liste für eine Episode dauert im Median etwa 1 Minute 54 Sekunden, gemessen über alle Listen, die in den dreißig Tagen bis zum 20. September 2026 auf scenemixer.com erfolgreich generiert wurden.
Jede Zeile der Liste ist bearbeitbarer Text, und das Bearbeiten kostet nichts – die einzigen kostenpflichtigen Vorgänge sind Modellaufrufe. Dieses Ungleichgewicht ist absichtlich so gewählt, weil es deine Arbeitsweise verändert: Einen Shot von Hand zu korrigieren und nur dieses Segment neu zu rendern ist günstig, während das Modell nach einer neuen Liste für die ganze Episode zu fragen genau so viel kostet wie die erste und alle manuellen Änderungen in dieser Episode verwirft. Für kleine Korrekturen: bearbeite. Für einen wirklich anderen Ansatz für die Episode: generiere neu.
Shotlisten werden pro Folge abgerechnet, basierend auf der Länge des Skripts, das die Folge abdeckt: 1 Credit pro 333 Zeichen englischer Text, zum gleichen Tarif für den ersten Durchgang und eine Neuerstellung. Die Skriptanalyse, die die Besetzung und die Folgenaufteilung erstellt, auf der die Liste basiert, kostet 4 Credits pro 3,333 Zeichen und läuft einmal für den gesamten Upload. Beim ersten Projekt ist die Shotlist für Folge 1 kostenlos, und jedes Konto startet mit 50 Credits. Das Rendern der Shots ist separat, ab 10 Credits pro Sekunde Ausgabematerial. Die vollständige Tabelle findest du auf der Preisseite.
Die Dialogtiming wird pro Sprache berechnet, sodass ein Shot lang genug für die jeweilige Zeile ist, egal in welcher Sprache diese vorliegt. Die Dialogsprache wird vor der Analyse ausgewählt und nativ umgesetzt, statt nachträglich synchronisiert zu werden; jede der unten aufgeführten Serien wurde auf diese Weise produziert.
Sprachen
Jede Serie unten wurde mit derselben Pipeline produziert, wobei die Darsteller die jeweilige Sprache auf muttersprachlichem Niveau sprechen: Oberfläche, Arbeitsdokumente und gesprochene Zeilen sind in einer Sprache, nichts ist synchronisiert. Öffne eine Serie, um es dir anzuhören.
A Carta de LisboaPortuguêsMuttersprachliche Dialoge
윈터 프라미스한국어Muttersprachliche Dialoge
El Secreto de CostaEspañolMuttersprachliche Dialoge
浪人の誓い日本語Muttersprachliche Dialoge
Ikrar JakartaBahasa IndonesiaMuttersprachliche Dialoge
Зимняя коронаРусскийMuttersprachliche Dialoge
L’Héritier du DéfiléFrançaisMuttersprachliche Dialoge
Il Tavolo dell'OlivaItalianoMuttersprachliche Dialoge
De Vuurtoren van de FjordNederlandsMuttersprachliche Dialoge
العهد الصحراويالعربيةMuttersprachliche Dialoge
Çantasındaki SözleşmeTürkçeMuttersprachliche Dialoge
Die Istanbul-TäuschungDeutschIn deiner Sprache
Останній сигналУкраїнськаMuttersprachliche Dialoge
問劍青雲繁體中文Muttersprachliche Dialoge
The Last EnvelopeEnglishMuttersprachliche DialogeDerzeit nicht. Die Liste befindet sich im Editor, da sie dort ausgeführt wird – sie ist gleichzeitig das Produktionsdokument und die Eingabe für das Rendern. Du kannst den Text jedes Segments kopieren, und die gesamte Liste ist reiner Text statt einer proprietären Struktur.
Ja. Der Text jedes Segments ist bearbeitbar, und du kannst Segmente einfügen, duplizieren oder löschen. Was das System in jedem Fall bereitstellt, ist die Verbindung zur Asset-Bibliothek: Wenn du eine Figur in einem Shot nennst, wird deren Referenzbild an das Rendering angehängt.
Es fügt Bewegungen hinzu, wo Bewegungen den Takt unterstützen – ein Heranfahren, eine langsame Kreisbewegung, eine handgeführte Verfolgung – und lässt sie weg, wo ein feststehender Bildausschnitt stärker wirkt. Es vermeidet bewusst aufwändige Bewegungen, die aktuelle Videomodelle in Verzerrungen umwandeln, und verwendet kein Fachjargon-Vokabular, auf das Bildmodelle einer früheren Generation reagiert haben.
Dialogshots werden anhand der Zeile selbst getimt, bei drei Wörtern pro Sekunde für Englisch, mit einem Mindestwert, damit sehr kurze Zeilen trotzdem gehalten werden. Nicht-dialogische Shots erhalten ihre Länge aus dem, was in ihnen passieren muss. Die Shotdauern eines Segments werden dann mit der Gesamtlänge des Segments abgeglichen, bevor die Liste gespeichert wird, und ein Segment, das überläuft, wird an einer Shotgrenze geteilt statt komprimiert.
Ja. Analyse und Shotlist sind separate Käufe vom Rendern, und nichts verpflichtet dich zum Rendern. Leute nutzen die Pipeline auf diese Weise – Skript rein, strukturierte Shotlist raus, das Material wird konventionell gedreht.
Füge ein Skript ein und lies die Liste der ersten Folge.
SceneMixer kostenlos testenCredit-Pakete ab $1.49 · Pro $7.99/Monat · Keine Kreditkarte zum Start nötig
Preise·Anleitungen·Beispiele·Support·Datenschutz·AGB·Rechtliches·Kontakt·© 2026 SceneMixer