
Derselbe 10-Sekunden-Clip auf Wan 3.0 · 480P: Lippensynchronisation kostet 10 × 1; Neu darstellen kostet 10 × 20. Probier zuerst die Lippensynchronisation aus.
Die Seite spricht jede Zeile des Segments mit der Stimme ein, die in der jeweiligen Zeile angezeigt wird, reiht sie nacheinander ab Clipbeginn mit kurzen Pausen dazwischen und nutzt das als neuen Tonspurl des Clips. Das Bild bleibt erhalten, und die Münder der Sprechenden werden passend zum neuen Audio bewegt. Daraus ergeben sich zwei Folgen: Die Pausen des Originals gehen verloren – Zeilen, die vorher über den ganzen Clip verteilt waren, kommen jetzt nacheinander. Und die Tonspur enthält nur die Stimmen: Musik und Umgebungsgeräusche aus dem Original sind weg.
Es sieht am besten aus, wenn Gesichter zur Kamera gedreht sind. Bei Profilgesichtern oder wenn eine sprechende Person klein im Bild ist, kann das Ergebnis weniger natürlich wirken oder klingen; hör dir die Stimme an, bevor du es startest.
Neu darstellen behandelt die neuen Zeilen als neuen Take: Der Clip wird aus sich selbst neu erstellt, wobei die Zeilen ersetzt und die gewählten Stimmen als Stimmproben der Sprechenden verwendet werden. Da die Performance neu erstellt wird, folgen Timing und Vortrag den neuen Wörtern und die Tonspur ist ein vollständiger Take inklusive Umgebungsgeräuschen. Bildausschnitt und Positionen richten sich nach deinem Clip, aber Gesichter und kleine Bewegungen können leicht abweichen. Es nutzt dieselbe Technik wie KI-Bildgenerierung – deshalb hat es denselben Preis und dasselbe 15-Sekunden-Limit.
Lippensynchronisation: 1 credit × die Länge des gesamten Clips in Sekunden. Neu darstellen: 2× der Preis pro Sekunde des Tarifs, mit dem der Clip erstellt wurde × die Länge. In jedem Tarif ist Neu darstellen ein Vielfaches des Preises von Lippensynchronisation; beide Preise stehen auf den beiden Modustasten, bevor du auswählst. Beide werden beim Drücken reserviert und erstattet, wenn die Nachvertonung nicht durchläuft. Jeder Fixpreis.
Beide schreiben geänderte Wörter zurück ins Storyboard, beide speichern eine Nachvertont-Version und behalten den generierten Clip, und ein Segment behält eine nachvertonte Version. Ändere eine Zeile, nachdem das Video erstellt wurde.
| Lippensynchronisation | Neu darstellen | |
|---|---|---|
| Bild | Jedes Bild erhalten | Neu erstellt; kleine Änderungen möglich |
| Stimmen | Neu eingesprochen, nacheinander ab Start | Eine neue Performance |
| Musik und Umgebungsgeräusche | Entfernt | Teil der neuen Performance |
| Cliplänge | Beliebig | Bis zu 15 Sekunden |
| Preis | 1 pro Sekunde | 2× Tarifpreis pro Sekunde |
| Werbe-Projekte | Ja, die Werbemusik geht verloren | Ja |
Der Clip ist länger als 15 Sekunden, oder das erneute Rendern ist für diesen Clip momentan nicht verfügbar. Nutze die Lippensynchronisation.
Bei der Lippensynchronisation bleiben nur die Stimmen erhalten. Neu darstellen behält eine vollständige Tonspur – bei Clips bis zu 15 Sekunden.
Nein. Die Zeilen werden nacheinander ab Start platziert. Neu darstellen folgt stattdessen dem neuen Vortrag.
Wechsle in der Versionsgeschichte zurück zu dem Clip, mit dem du angefangen hast; er wird immer behalten. Eine Nachvertonung, die bei seitlicher oder kleiner Sprecherperson schlecht aussieht, funktioniert meist besser als Neu darstellen bei einem Clip von bis zu 15 Sekunden.
Bei Gesichtern zur Kamera ist die Lippensynchronisation meist überzeugend und viel günstiger. Seitliche oder sehr kleine Sprecherpersonen sind schwieriger dafür; wenn das Ergebnis schlecht aussieht, probier Neu darstellen bei einem Clip bis zu 15 Sekunden aus, oder generiere das Segment mit der neuen Zeile neu.
Sie ist die günstigere Variante; wechsle zu Neu darstellen, wenn der Ton einen neuen Take braucht.
Aktualisiert am 2. Oktober 2026
Preise·Anleitungen·Beispiele·Support·Datenschutz·AGB·Rechtliches·Kontakt·© 2026 SceneMixer