SceneMixer
Italiano
Registrati gratis

Personaggi coerenti

Generatore di video AI con personaggi coerenti

Aggiornato il 20 settembre 2026

Risposta breve: la deriva dei personaggi è ciò che impedisce alla maggior parte dei video AI di diventare una serie: al quinto episodio il protagonista ha una mascella diversa e il pubblico smette di credere che sia lo stesso show. SceneMixer la contrasta con quattro meccanismi: un cast generato una sola volta come fogli di riferimento, ritagli di volto e corpo allegati a ogni segmento in cui compare il personaggio, riferimenti collegati tramite identificatore anziché per nome e una regola esplicita che vieta di nominare persone che non sono nell'inquadratura. I cambiamenti intenzionali ottengono la propria concept sheet invece di essere affidati a un prompt.
Fotogramma da “The Glass Floor”, un cortometraggio AI generato end-to-end da SceneMixer (5 personaggi, 1 episodio)
Esempio: “The Glass Floor” — Realistico HD, 1 episodio, prodotto end-to-end da SceneMixer a partire dalla sceneggiatura · guarda gli episodi

Perché i personaggi vanno alla deriva in primo luogo

Un modello text-to-video esegue ogni generazione in modo indipendente. Descrivi una donna sulla trentina con una cicatrice su un sopracciglio nella ripresa 1 e di nuovo nella ripresa 30, e otterrai due donne che corrispondono alla descrizione ma non l'una all'altra: gli aggettivi non definiscono un volto in modo univoco. Ogni soluzione qui sotto applica la stessa idea in un punto diverso: smetti di descrivere il personaggio e consegna al modello una sua foto.

Quattro blocchi di sicurezza

Cosa fa ogni meccanismo
Foglio di riferimentoOgni personaggio viene generato una sola volta come foglio a figura intera in formato 9:16 su sfondo neutro con illuminazione chiave direzionale: è una foto di casting, non un'immagine d'atmosfera, perché qualsiasi luce impressa nel foglio viene ereditata da ogni ripresa che lo utilizza.
Ritagli allegatiI ritagli di volto e corpo da quel foglio vengono inviati con ogni segmento in cui compare il personaggio. Il modello abbina un'immagine invece di interpretare una descrizione.
Collegamenti per idGli storyboard puntano alle risorse tramite identificatore, non per nome. Due personaggi con lo stesso nome, o un cambio di nome a metà progetto, non interrompono più la catena silenziosamente.
Regola sui personaggi fuori campoUn personaggio che viene solo guardato, a cui si parla o a cui si tende la mano — e che non è nell'inquadratura — viene scritto come indicazione di regia, mai nominato. Nominare un personaggio assente è ciò che fa sì che il modello incolli il suo volto in una ripresa con una sola persona.

Un quinto meccanismo, più piccolo: ogni persona in una ripresa porta con sé uno o due tratti facciali distintivi estratti dalla propria descrizione, il che attenua il classico errore per cui due personaggi con la stessa uniforme si scambiano i volti a metà ripresa.

Quando il personaggio deve cambiare

La coerenza non può significare "non cambia mai": un personaggio che prende fuoco nell'episodio 6 deve apparire ustionato nell'episodio 7. La linea di demarcazione è tracciata da come un modello video tratta un'immagine di riferimento: copre volto, abbigliamento, forma e struttura quasi letteralmente, e applica luce, meteo e ora del giorno come effetti sovrapposti.

Invertire questa logica è costoso in entrambi i sensi: una variante per "tiene la tazza" è un'immagine che hai pagato e non vedrai mai, e un prompt per "dopo l'incendio" è una richiesta che il modello ignorerà educatamente a favore della stanza pulita nel suo riferimento.

Cosa non è ancora risolto

La spiegazione stratificata, con cosa ogni strato può e non può catturare, si trova in la guida alla coerenza dei personaggi.

Quanto costa

I fogli di riferimento sono una voce di costo separata, distinta dall'analisi della sceneggiatura (4 crediti per 3,333 caratteri di testo in inglese): ogni account riceve 15 immagini di riferimento gratuite, e le immagini aggiuntive o rigenerate dopo quella soglia costano 7 crediti ciascuna sul modello immagini predefinito. Le varianti di stato hanno una piccola franchigia gratuita sul primo progetto e vengono fatturate come immagini dopo di che. Il video stesso parte da 10 crediti al secondo di output (≈ $0.06/s al piano prezzo più basso per credito) indipendentemente dal fatto che i riferimenti siano allegati o meno — la coerenza non è un supplemento. Dettagli sulla pagina dei prezzi.

Dimostralo sul tuo cast, gratuitamente

La coerenza è l'unica affermazione in questa categoria che non dovresti mai accettare sulla fiducia, e non sei obbligato a farlo. Un nuovo account include 50 crediti, 15 immagini di riferimento gratuite tra personaggi, scene e oggetti di scena, uno storyboard gratuito per l'episodio 1 sul tuo primo progetto e un'anteprima gratuita fino a 5 secondi che renderizza la ripresa di apertura del tuo episodio sui tuoi fogli. È sufficiente per un test reale:

  1. Incolla una scena in cui le stesse due persone compaiono più volte, a distanza di minuti.
  2. Lascia che l'analisi costruisca il cast, poi leggi le descrizioni dei personaggi e correggi eventuali errori prima che vengano generate le immagini: i fogli sono generati da quel testo.
  3. Genera i fogli. Un'immagine di riferimento impiega circa 16 secondi come valore mediano, e 9 su 10 terminano entro 27 secondi, quindi un cast di cinque persone richiede un paio di minuti.
  4. Usa l'anteprima gratuita su una ripresa in cui un personaggio sta facendo qualcosa, non stando fermo, e confronta il volto con il foglio.

Per calibrare: il progetto mediano su questa piattaforma ha cinque personaggi nominati, e nove su dieci ne hanno meno di dieci. Se la tua storia ne richiede trenta, lo stesso meccanismo si applica comunque — il costo sono i fogli, non la coerenza.

Ogni episodio, in quindici lingue

La lingua dei dialoghi si imposta una sola volta nel Passaggio 1 e l'intera generazione viene eseguita in quella lingua; l'impostazione della regione di destinazione adatta contemporaneamente nomi, volti e strade a quel mercato. Tutti gli esempi qui sotto sono stati prodotti in questo modo, uno per lingua.

Lingue

Dialoghi nativi in 15 lingue

Ogni serie qui sotto è stata prodotta con la stessa pipeline, con il cast che parla la lingua in modo nativo: interfaccia, documenti di lavoro e battute sono tutti nella stessa lingua, niente doppiaggio. Aprila per ascoltarla.

Vedi tutte le 15 lingue

Domande frequenti

Quanto è davvero consistente?

L'obiettivo di progetto è avere lo stesso volto per tutta la serie, ed è esattamente ciò che l'architettura basata sulle schede di riferimento garantisce per i personaggi nella tua libreria di risorse. Non si tratta di una garanzia valida per ogni singolo fotogramma: i casi più difficili rimangono i personaggi con abiti identici nella stessa inquadratura e i personaggi la cui scheda di riferimento mostra principalmente il cappotto. Tutto il resto — numero di episodi, tempo trascorso, numero di inquadrature in cui compare un personaggio — non peggiora la consistenza, perché ogni inquadratura viene confrontata con la stessa immagine.

Posso caricare l'immagine di un personaggio invece di generarne una?

Sì. Qualsiasi scheda di riferimento può essere sostituita con un'immagine caricata da te, e il resto della pipeline la tratta esattamente come una scheda generata. È la procedura da usare per un personaggio che hai già progettato altrove.

Funziona con il volto di una persona reale?

Tecnicamente, la funzione di caricamento non si cura di cosa sia l'immagine, ma pubblicare video AI con le sembianze di una persona reale costituisce un problema legale nella maggior parte dei mercati, e la nostra guida alla conformità lo tratta come tale. Non forniamo uno strumento di face-swap e non ne consigliamo l'uso.

Cosa succede se rinomino un personaggio a progetto in corso?

Non si rompe niente. Gli storyboard fanno riferimento alle risorse tramite identificatore, e la modifica del nome viene propagata a tutti i testi salvati contemporaneamente. Prima di settembre 2026 i riferimenti venivano associati per nome, ed è esattamente il problema che questa modifica ha risolto.

Mantenere un personaggio consistente ha un costo aggiuntivo per ogni inquadratura?

No. Associare un'immagine di riferimento a un segmento non cambia la tariffa al secondo: paghi una sola volta per ogni scheda di riferimento, poi non paghi nient'altro indipendentemente da quante inquadrature la usano. La consistenza qui è una scelta architetturale, non un servizio a pagamento extra.

Devo descrivere di nuovo il personaggio in ogni inquadratura?

No, e non dovresti farlo. Nel testo dell'inquadratura indichi il nome del personaggio; l'immagine di riferimento definisce il suo aspetto. Ripetere la descrizione fisica nel testo dell'inquadratura spinge il modello a basarsi sulle parole invece che sull'immagine, che è esattamente il problema di deriva che questo design elimina.

Un personaggio può avere due aspetti diversi nello stesso episodio?

Sì: è esattamente a questo che servono le varianti di stato. Ogni aspetto ha la sua immagine di riferimento, e lo storyboard stabilisce per ogni segmento quale usare, con precisione sul singolo segmento e non sull'intero episodio.

Lo stesso volto dall'episodio 1 all'episodio 40

Genera i personaggi una sola volta; ogni inquadratura successiva si basa su un'immagine, non su una descrizione.

Prova SceneMixer gratis

Pacchetti di crediti a partire da $1.49 · Pro $7.99/mese · Nessuna carta di credito richiesta per iniziare

Prezzi·Guide·Esempi·Supporto·Privacy·Termini·Note legali·Contatti·© 2026 SceneMixer