SceneMixer
Deutsch
Kostenlos registrieren

Lippensynchronisation oder Neu darstellen: So wählst du die Nachvertonung für einen Clip

Kurze Antwort: Lippensynchronisation ist die Standardeinstellung: Das Bild bleibt Bild für Bild erhalten, jede Zeile wird neu eingesprochen und die Münder passend dazu bewegt; die Originalumgebungsgeräusche fallen weg. Sie kostet 1 credit pro Sekunde Clip und funktioniert bei Clips beliebiger Länge. Neu darstellen spielt den Clip mit den neuen Zeilen neu ab, sodass Vortrag und Timing zu den Wörtern passen und der Ton eine vollständige neue Performance ist – aber das Bild kann sich leicht verschieben. Sie kostet 2× den Preis pro Sekunde des Tarifs des Clips und ist nur für Clips von 15 Sekunden oder kürzer verfügbar.
Standbild aus „Neon Debt“, einer vollständig von SceneMixer generierten AI-Kurzserie (7 Charaktere, 1 Episode)
Beispiel: „Neon Debt“ — Spielengine-Realismus, 1 Episode, vollständig von SceneMixer aus dem Skript produziert · Episoden ansehen

Derselbe 10-Sekunden-Clip auf Wan 3.0 · 480P: Lippensynchronisation kostet 10 × 1; Neu darstellen kostet 10 × 20. Probier zuerst die Lippensynchronisation aus.

So funktioniert die Lippensynchronisation

Die Seite spricht jede Zeile des Segments mit der Stimme ein, die in der jeweiligen Zeile angezeigt wird, reiht sie nacheinander ab Clipbeginn mit kurzen Pausen dazwischen und nutzt das als neuen Tonspurl des Clips. Das Bild bleibt erhalten, und die Münder der Sprechenden werden passend zum neuen Audio bewegt. Daraus ergeben sich zwei Folgen: Die Pausen des Originals gehen verloren – Zeilen, die vorher über den ganzen Clip verteilt waren, kommen jetzt nacheinander. Und die Tonspur enthält nur die Stimmen: Musik und Umgebungsgeräusche aus dem Original sind weg.

Es sieht am besten aus, wenn Gesichter zur Kamera gedreht sind. Bei Profilgesichtern oder wenn eine sprechende Person klein im Bild ist, kann das Ergebnis weniger natürlich wirken oder klingen; hör dir die Stimme an, bevor du es startest.

So funktioniert Neu darstellen

Neu darstellen behandelt die neuen Zeilen als neuen Take: Der Clip wird aus sich selbst neu erstellt, wobei die Zeilen ersetzt und die gewählten Stimmen als Stimmproben der Sprechenden verwendet werden. Da die Performance neu erstellt wird, folgen Timing und Vortrag den neuen Wörtern und die Tonspur ist ein vollständiger Take inklusive Umgebungsgeräuschen. Bildausschnitt und Positionen richten sich nach deinem Clip, aber Gesichter und kleine Bewegungen können leicht abweichen. Es nutzt dieselbe Technik wie KI-Bildgenerierung – deshalb hat es denselben Preis und dasselbe 15-Sekunden-Limit.

Auswahl

Preis im Vergleich

Lippensynchronisation: 1 credit × die Länge des gesamten Clips in Sekunden. Neu darstellen: 2× der Preis pro Sekunde des Tarifs, mit dem der Clip erstellt wurde × die Länge. In jedem Tarif ist Neu darstellen ein Vielfaches des Preises von Lippensynchronisation; beide Preise stehen auf den beiden Modustasten, bevor du auswählst. Beide werden beim Drücken reserviert und erstattet, wenn die Nachvertonung nicht durchläuft. Jeder Fixpreis.

In beiden Fällen

Beide schreiben geänderte Wörter zurück ins Storyboard, beide speichern eine Nachvertont-Version und behalten den generierten Clip, und ein Segment behält eine nachvertonte Version. Ändere eine Zeile, nachdem das Video erstellt wurde.

LippensynchronisationNeu darstellen
BildJedes Bild erhaltenNeu erstellt; kleine Änderungen möglich
StimmenNeu eingesprochen, nacheinander ab StartEine neue Performance
Musik und UmgebungsgeräuscheEntferntTeil der neuen Performance
CliplängeBeliebigBis zu 15 Sekunden
Preis1 pro Sekunde2× Tarifpreis pro Sekunde
Werbe-ProjekteJa, die Werbemusik geht verlorenJa

FAQ

Warum ist Neu darstellen ausgegraut?

Der Clip ist länger als 15 Sekunden, oder das erneute Rendern ist für diesen Clip momentan nicht verfügbar. Nutze die Lippensynchronisation.

Warum klingt der lippensynchronisierte Clip leer?

Bei der Lippensynchronisation bleiben nur die Stimmen erhalten. Neu darstellen behält eine vollständige Tonspur – bei Clips bis zu 15 Sekunden.

Kann ich die Originalpausen bei der Lippensynchronisation behalten?

Nein. Die Zeilen werden nacheinander ab Start platziert. Neu darstellen folgt stattdessen dem neuen Vortrag.

Der nachvertonte Clip sieht oder klingt falsch. Was nun?

Wechsle in der Versionsgeschichte zurück zu dem Clip, mit dem du angefangen hast; er wird immer behalten. Eine Nachvertonung, die bei seitlicher oder kleiner Sprecherperson schlecht aussieht, funktioniert meist besser als Neu darstellen bei einem Clip von bis zu 15 Sekunden.

Was sieht natürlicher aus?

Bei Gesichtern zur Kamera ist die Lippensynchronisation meist überzeugend und viel günstiger. Seitliche oder sehr kleine Sprecherpersonen sind schwieriger dafür; wenn das Ergebnis schlecht aussieht, probier Neu darstellen bei einem Clip bis zu 15 Sekunden aus, oder generiere das Segment mit der neuen Zeile neu.

Fang mit der Lippensynchronisation an

Sie ist die günstigere Variante; wechsle zu Neu darstellen, wenn der Ton einen neuen Take braucht.

Öffne dein Projekt

Aktualisiert am 2. Oktober 2026

Preise·Anleitungen·Beispiele·Support·Datenschutz·AGB·Rechtliches·Kontakt·© 2026 SceneMixer