SceneMixer
Deutsch
Kostenlos registrieren

MiniMax H3

Kurze Antwort: MiniMax H3 ist die 2K-Stufe auf SceneMixer. Wie die anderen Videostufen erzeugt sie Bild und Ton zusammen und kann innerhalb eines Segments zwischen mehreren Einstellungen schneiden. Was sie auszeichnet, ist das 2K-Bild, Segmente von bis zu 15 Sekunden und eigene Referenzlimits von 9 Bildern sowie 3 Sprachclips. Sie kostet 25 Credits pro Sekunde (ca. $0.16 beim günstigsten Credit-Preis). Wähle sie, wenn du ein 15-Sekunden-Segment in 2K willst, und behalte die Anzahl der Referenzen im Blick.
Standbild aus „Neon Debt“, einer vollständig von SceneMixer generierten AI-Kurzserie (7 Charaktere, 1 Episode)
Beispiel: „Neon Debt“ — Spielengine-Realismus, 1 Episode, vollständig von SceneMixer aus dem Skript produziert · Episoden ansehen

H3 Fast ist das 768P-Pendant mit gleichen Regeln zu einem günstigeren Tarif.

Wo du sie auswählst

Zwei Stellen, eine Einstellung. Im Episoden-Editor: die Schaltfläche in der oberen Leiste, die den Namen der aktuellen Stufe anzeigt, neben Composite. In den Einstellungen: Modell-Einstellungen → Videomodell. Beides ändert dasselbe — die Stufe, auf der deine nächsten Segmente gerendert werden, in diesem Projekt und in neuen. Bereits erstellte Segmente behalten ihre Stufe, und jede Version speichert sie. Der Preis auf der Generieren-Schaltfläche eines Segments zeigt immer die Stufe an, die du gerade verwenden wirst.

Was ein Segment auf dieser Stufe sein kann

Länge: bis zu 15 Sekunden pro Generierung; der 30-Sekunden-Long-Take-Modus ist hier nicht verfügbar. Auflösung: 2K im Seitenverhältnis des Projekts. Ton: immer aktiv — Dialoge in der Stimme jeder Figur und Umgebungsgeräusche sind in jedem Render enthalten. Schnitte: ein Segment kann mehrere Einstellungen mit echten Schnitten dazwischen in einer einzigen Generierung enthalten; die Shot-Liste des Storyboards ist der Schnitt.

Referenzen: Die Regel, an der die meisten scheitern

Zwei Limits solltest du beachten: bis zu 9 Bilder und bis zu 3 Sprachclips (insgesamt ca. 14 Sekunden Sprache). Wenn ein Segment diese Limits überschreiten würde, lässt die Seite die unwichtigsten Referenzen zuerst weg. Ein Segment, das viele Figuren und Requisiten plus deren Stimmen nennt, kann die Limits erreichen; wenn das passiert, nimm weniger, dafür bessere Referenzen. Ein Segment behält höchstens drei Sprachclips (weniger, wenn sie zusammen länger als ca. 14 Sekunden sind); die anderen Sprecher nutzen ihre schriftliche Stimmbeschreibung. Sprachclips brauchen ein Bild dazu: Wenn ein Segment Stimmen, aber kein Bild enthalten würde, verwirft die Seite die Sprachclips und greift auf die schriftliche Stimmbeschreibung jeder Figur zurück.

Was es kostet

25 Credits pro Sekunde. H3 Fast kostet 16 pro Sekunde für die gleichen Regeln in 768P; zum Vergleich: Die Wan-1080P-Stufe kostet 38 pro Sekunde. Credits werden bei Lieferung abgezogen; schlägt eine Generierung fehl, kommen die Credits zurück oder werden gehalten, bis der Support es prüft.

Worin sie gut ist und worauf du achten solltest

Gut für: ein 15-Sekunden-Segment, das scharf genug für einen großen Bildschirm gerendert ist — wie die Wan-Stufen kann es einen Blickwechsel, eine Reaktion und einen Insert mit Schnitten dazwischen enthalten. Achtung: das Referenzlimit, die Obergrenze von 15 Sekunden und die Tatsache, dass diese Familie eigene Referenzlimits hat, anders als die Wan-Stufen; ein Segment, das auf einer Wan-Stufe funktionierte, braucht hier eventuell ausgedünnte Referenzen.

Inhaltsprüfungen

Text und Referenzen werden vor dem Rendern geprüft. Eine Ablehnung kostet nichts: Die Credits kommen zurück, und die Credit-Historie zeigt das an. Die Zählung erfolgt pro Konto: Nach 12 Ablehnungen innerhalb von 24 Stunden wird die nächste zur Prüfung gehalten statt erstattet, und die Videogenerierung pausiert für 1 Stunde. Bearbeite also das markierte Material, statt dasselbe Segment erneut zu versuchen. Inhaltsregeln und Prüfungen erklärt, was markiert wird.

Häufige Fehler

Meldungen, die dir auf dieser Stufe begegnen können:

Was du siehstÜbliche UrsacheWas zu tun ist
„Ungültige Eingabe — prüfe die Referenzbilder und die Dauer, dann versuche es erneut.“Meistens konnte eine der Referenzdateien für dieses Segment nicht gelesen werdenGeneriere einmal neu; wenn es weiterhin fehlschlägt, prüfe, ob sich die Figuren-, Orts- und Requisitenbilder öffnen lassen, und kontaktiere dann den Support
„Durch Inhaltssicherheitsregeln blockiert — bearbeite Skript oder Beschreibung und versuche es erneut.“Das Skript oder eine Referenz hat die Inhaltsprüfung ausgelöstBearbeite den markierten Teil; siehe den Abschnitt zur Inhaltsprüfung, wann eine Ablehnung erstattet wird
„Der Generierungsdienst hatte ein vorübergehendes Problem. Dir wurden keine Credits abgezogen — du kannst es gerne erneut versuchen.“Der Dienst war ausgelastet; die Seite hat bereits einmal erneut für dich versuchtWarte ein paar Minuten und generiere neu; es wurde nichts abgezogen
Videogenerierung pausiertMehr als 12 abgelehnte Generierungen innerhalb von 24 Stunden; die nächste wird zur Prüfung gehaltenWarte die Pause ab (1 Stunde); korrigiere das Material, bevor du es erneut versuchst

Wann du die Stufe wechseln solltest

Zu H3 Fast für die gleichen Regeln zu einem günstigeren Tarif während der Entwurfsphase. Zu einer Wan- oder Seedance-2.5-Stufe, wenn eine Szene mehr als 9 Bildreferenzen oder eine ununterbrochene 30-Sekunden-Einstellung braucht — letzteres nur, wenn das Storyboard der Episode mit 30-Sekunden-Segmenten erstellt wurde. Jedes Segment merkt sich seine Stufe.

ReferenztypLimit auf dieser StufeHinweis
BilderBis zu 9Mindestens ein Bild ist erforderlich, wenn irgendeine Referenz angehängt ist
SprachclipsBis zu 3, insgesamt ca. 14 sStimmen brauchen ein Bild dazu; ohne Bild verwirft die Seite die Sprachclips und nutzt die schriftlichen Stimmbeschreibungen
Über einem Limit—Die Seite lässt die unwichtigsten Referenzen zuerst weg; eine Figur, deren Stimme weggelassen wird, spricht anhand der schriftlichen Stimmbeschreibung

FAQ

Ist 2K höher als die 1080P-Stufen?

Ja, in der Pixelanzahl. Ob das sichtbar ist, hängt davon ab, wo der Clip angesehen wird; auf Handys ist der Unterschied klein.

Warum wurde eine Referenz aus meinem Segment entfernt?

Das Segment hatte mehr als 9 Bilder, mehr als 3 Sprachclips oder zu viele Sprachsekunden, oder ein Sprachclip hatte kein Bild dazu. Nenne weniger Figuren oder Requisiten in diesem Segment und generiere neu.

Kann H3 einen 30-Sekunden-Take rendern?

Nein. Segmente auf dieser Stufe sind bis zu 15 Sekunden lang.

Fügt H3 immer Ton hinzu?

Ja. Jeder Render enthält Dialoge und Umgebungsgeräusche; es gibt keinen Stummmodus.

Können H3-Segmente in einer Episode mit Wan-Segmenten gemischt werden?

Ja. Jedes Segment merkt sich seine Stufe, und das Composite fügt die aktiven Versionen zusammen.

Ein 15-Sekunden-Segment in 2K rendern

Wähle H3 für ein Segment, das du in 2K willst, halte die Referenzen knapp und prüfe, wie es auf einem großen Bildschirm wirkt.

Ein Projekt starten

Aktualisiert am 27. September 2026

Preise·Anleitungen·Beispiele·Support·Datenschutz·AGB·Rechtliches·Kontakt·© 2026 SceneMixer