
Die Anzeigen-Pipeline läuft auf derselben Engine wie die Serien-Pipeline, also ist das erzeugte Storyboard dasselbe Arbeitsdokument, das du in diesem Beispielprojekt sehen kannst.
Bis zu vier Fotos desselben Motivs: verschiedene Winkel, eine Detailaufnahme, das Ding im Einsatz. Das erste Foto gilt als Hauptmotiv – darauf baut die Endkarte auf, und bei einem Produkt, Gericht oder Kleidungsstück wird es als saubere Aufnahme auf Weiß neu gezeichnet. Ein Laden, ein Auto oder ein App-Bildschirm wird nicht neu gezeichnet (siehe unten). Die übrigen Fotos werden zu Schauplätzen.
Sie werden eingelesen, bevor etwas berechnet wird. Wenn das Ergebnis unbrauchbar ist – zu unscharf, nichts Erkennbares, ein Screenshot in einem seltsamen Seitenverhältnis –, bekommst du das sofort angezeigt, und es wird nichts abgebucht.
Neben dem Upload gibt es ein einzeiliges Feld. Nutze es, wenn das Bild allein irreführend ist: „Das ist unser Laden, kein Stock-Foto“ ändert die gesamte Behandlung, weil ein Laden ein Ort ist, an dem die Anzeige drinnen stattfindet, während ein Produkt ein Requisit ist, um das die Anzeige herum stattfindet.
Wenn Satz und Foto nicht übereinstimmen, gewinnt der Satz – das ist die einzige Stelle, an der das, was du eintippst, Vorrang vor dem hat, was das Modell sieht.
Die Länge beträgt 15, 30 oder 60 Sekunden, also ein, zwei oder vier Segmente zu je fünfzehn Sekunden. Der Ton wählt das narrative Rezept – Spektakel, witzig, warm, minimalistisch, Twist, Appetit, Demo oder Lifestyle – und jedes bringt seine eigene Art Direction sowie seine eigene Struktur mit.
Die Auflösung ist 480p, 720p oder 1080p. Der Preis bei jeder Option umfasst bereits alle Schritte, also ist die angezeigte Zahl der Betrag, den du zahlst.
Wenn du es der KI übergibst, läuft die gesamte Kette unbeaufsichtigt, und es wird dir vorab ein Gesamtpreis genannt: Foto bereinigen, Skript schreiben, es aufteilen, Besetzung und Sets generieren, jedes Segment drehen, mit der Endkarte zusammensetzen.
Der Schritt-für-Schritt-Modus kostet weniger im Voraus und gibt dir nach dem Schreiben des Skripts den normalen Editor, sodass du eine Zeile umschreiben, eine Figur ändern oder ein Segment neu drehen kannst, bevor du den Rest bezahlst.
Produkte, Lebensmittel und Kleidung werden als saubere Studioaufnahme auf Weiß neu gezeichnet, damit sie in jedem Segment konsistent beleuchtet werden können. Läden, Restaurants, Autos und Häuser werden nicht neu gezeichnet – wenn man sie aus ihrer Umgebung ausschneidet, gehen Beschilderung, Tiefenwirkung und das Größengefühl verloren, die sie wiedererkennbar machen. App- und Web-Screenshots werden ebenfalls nicht neu gezeichnet; Neuzzeichnen macht lesbare Oberflächen zu unleserlichem Brei.
Wenn auf einem Foto eines Ortes oder Fahrzeugs Personen zu sehen sind, werden diese vor allem anderen entfernt. Ein Modell, dem ein Referenzbild gegeben wird, kopiert die darin enthaltenen Gesichter, und wir werden keinen echten Passanten in deine Anzeige einbauen.
Superlative und absolute Aussagen werden vor der Produktion aus dem Skript entfernt – „der niedrigste Preis überhaupt“, „Nummer eins im Verkauf“, „heilt alles“. Marken- und Produktnamen durchlaufen denselben Prüfdurchgang, aber nur gegen diese kürzere Liste unzulässiger Aussagen – eine gewöhnliche Marke bleibt unangetastet, während ein Name, der selbst eine Aussage trifft („#1“, „100%“, „garantiert“), abgeschwächt wird.
Jedes Segment enthält mindestens eine gesprochene Zeile, und der Slogan wird vor dem letzten Standbild laut ausgesprochen. Nichts Lesbares wird ins Bild geschrieben – Videomodelle können keinen lesbaren Text zuverlässig darstellen, also werden die Worte, die ankommen müssen, per Stimme und über die Endkarte übermittelt.
| Einstellung | Funktion |
|---|---|
| Fotos | 1–4 desselben Motivs; das erste ist das Hauptmotiv |
| Länge | 15s / 30s / 60s → 1 / 2 / 4 Segmente |
| Ton | Acht narrative Rezepte, jedes mit eigener Art Direction |
| Auflösung | 480p / 720p / 1080p, Preis pro Option angezeigt |
| Endkarte | Marke, Produkt, Slogan, Handlungsaufruf |
| Musik | Mit dem Bild generiert, nicht nachträglich hinzugefügt |
Nein. Das Skript wird aus den Fotos und der einzeiligen Beschreibung geschrieben. Im Schritt-für-Schritt-Modus kannst du es umschreiben, bevor etwas gedreht wird.
Ja, und es wird absichtlich anders behandelt: Ein Ort wird zum Schauplatz, an dem die Anzeige drinnen stattfindet, und die erste Szene wird aus deinem eigenen Foto nachgebaut statt aus Text erdacht.
Nur auf der Endkarte. Videomodelle können lesbaren Text nicht zuverlässig darstellen, also kommt alles, was exakt lesbar sein muss, auf die Karte am Ende, und alles andere wird gesprochen.
Bei Läden, Restaurants und Fahrzeugen werden sie vor dem Dreh entfernt. Screenshots mit Personen werden direkt abgelehnt statt bearbeitet.
Du kannst sie mit anderem Endkartentext neu zusammensetzen, und im Schritt-für-Schritt-Modus kannst du einzelne Segmente neu drehen. Die fertige Datei kann außerdem heruntergeladen und über einen Link geteilt werden.
Das Einlesen ist kostenlos, und der Preis für die gesamte Anzeige wird angezeigt, bevor du startest.
Aktualisiert am 21. September 2026
Preise·Anleitungen·Beispiele·Support·Datenschutz·AGB·Rechtliches·Kontakt·© 2026 SceneMixer