Personaggi coerenti
Aggiornato il 20 settembre 2026

Un modello text-to-video esegue ogni generazione in modo indipendente. Descrivi una donna sulla trentina con una cicatrice su un sopracciglio nella ripresa 1 e di nuovo nella ripresa 30, e otterrai due donne che corrispondono alla descrizione ma non l'una all'altra: gli aggettivi non definiscono un volto in modo univoco. Ogni soluzione qui sotto applica la stessa idea in un punto diverso: smetti di descrivere il personaggio e consegna al modello una sua foto.
| Foglio di riferimento | Ogni personaggio viene generato una sola volta come foglio a figura intera in formato 9:16 su sfondo neutro con illuminazione chiave direzionale: è una foto di casting, non un'immagine d'atmosfera, perché qualsiasi luce impressa nel foglio viene ereditata da ogni ripresa che lo utilizza. |
|---|---|
| Ritagli allegati | I ritagli di volto e corpo da quel foglio vengono inviati con ogni segmento in cui compare il personaggio. Il modello abbina un'immagine invece di interpretare una descrizione. |
| Collegamenti per id | Gli storyboard puntano alle risorse tramite identificatore, non per nome. Due personaggi con lo stesso nome, o un cambio di nome a metà progetto, non interrompono più la catena silenziosamente. |
| Regola sui personaggi fuori campo | Un personaggio che viene solo guardato, a cui si parla o a cui si tende la mano — e che non è nell'inquadratura — viene scritto come indicazione di regia, mai nominato. Nominare un personaggio assente è ciò che fa sì che il modello incolli il suo volto in una ripresa con una sola persona. |
Un quinto meccanismo, più piccolo: ogni persona in una ripresa porta con sé uno o due tratti facciali distintivi estratti dalla propria descrizione, il che attenua il classico errore per cui due personaggi con la stessa uniforme si scambiano i volti a metà ripresa.
La coerenza non può significare "non cambia mai": un personaggio che prende fuoco nell'episodio 6 deve apparire ustionato nell'episodio 7. La linea di demarcazione è tracciata da come un modello video tratta un'immagine di riferimento: copre volto, abbigliamento, forma e struttura quasi letteralmente, e applica luce, meteo e ora del giorno come effetti sovrapposti.
Invertire questa logica è costoso in entrambi i sensi: una variante per "tiene la tazza" è un'immagine che hai pagato e non vedrai mai, e un prompt per "dopo l'incendio" è una richiesta che il modello ignorerà educatamente a favore della stanza pulita nel suo riferimento.
La spiegazione stratificata, con cosa ogni strato può e non può catturare, si trova in la guida alla coerenza dei personaggi.
I fogli di riferimento sono una voce di costo separata, distinta dall'analisi della sceneggiatura (4 crediti per 3,333 caratteri di testo in inglese): ogni account riceve 15 immagini di riferimento gratuite, e le immagini aggiuntive o rigenerate dopo quella soglia costano 7 crediti ciascuna sul modello immagini predefinito. Le varianti di stato hanno una piccola franchigia gratuita sul primo progetto e vengono fatturate come immagini dopo di che. Il video stesso parte da 10 crediti al secondo di output (≈ $0.06/s al piano prezzo più basso per credito) indipendentemente dal fatto che i riferimenti siano allegati o meno — la coerenza non è un supplemento. Dettagli sulla pagina dei prezzi.
La coerenza è l'unica affermazione in questa categoria che non dovresti mai accettare sulla fiducia, e non sei obbligato a farlo. Un nuovo account include 50 crediti, 15 immagini di riferimento gratuite tra personaggi, scene e oggetti di scena, uno storyboard gratuito per l'episodio 1 sul tuo primo progetto e un'anteprima gratuita fino a 5 secondi che renderizza la ripresa di apertura del tuo episodio sui tuoi fogli. È sufficiente per un test reale:
Per calibrare: il progetto mediano su questa piattaforma ha cinque personaggi nominati, e nove su dieci ne hanno meno di dieci. Se la tua storia ne richiede trenta, lo stesso meccanismo si applica comunque — il costo sono i fogli, non la coerenza.
La lingua dei dialoghi si imposta una sola volta nel Passaggio 1 e l'intera generazione viene eseguita in quella lingua; l'impostazione della regione di destinazione adatta contemporaneamente nomi, volti e strade a quel mercato. Tutti gli esempi qui sotto sono stati prodotti in questo modo, uno per lingua.
Lingue
Ogni serie qui sotto è stata prodotta con la stessa pipeline, con il cast che parla la lingua in modo nativo: interfaccia, documenti di lavoro e battute sono tutti nella stessa lingua, niente doppiaggio. Aprila per ascoltarla.
A Carta de LisboaPortuguêsDialoghi nativi
윈터 프라미스한국어Dialoghi nativi
El Secreto de CostaEspañolDialoghi nativi
浪人の誓い日本語Dialoghi nativi
Ikrar JakartaBahasa IndonesiaDialoghi nativi
Зимняя коронаРусскийDialoghi nativi
L’Héritier du DéfiléFrançaisDialoghi nativi
Il Tavolo dell'OlivaItalianoNella tua lingua
De Vuurtoren van de FjordNederlandsDialoghi nativi
العهد الصحراويالعربيةDialoghi nativi
Çantasındaki SözleşmeTürkçeDialoghi nativi
Die Istanbul-TäuschungDeutschDialoghi nativi
Останній сигналУкраїнськаDialoghi nativi
問劍青雲繁體中文Dialoghi nativi
The Last EnvelopeEnglishDialoghi nativiL'obiettivo di progetto è avere lo stesso volto per tutta la serie, ed è esattamente ciò che l'architettura basata sulle schede di riferimento garantisce per i personaggi nella tua libreria di risorse. Non si tratta di una garanzia valida per ogni singolo fotogramma: i casi più difficili rimangono i personaggi con abiti identici nella stessa inquadratura e i personaggi la cui scheda di riferimento mostra principalmente il cappotto. Tutto il resto — numero di episodi, tempo trascorso, numero di inquadrature in cui compare un personaggio — non peggiora la consistenza, perché ogni inquadratura viene confrontata con la stessa immagine.
Sì. Qualsiasi scheda di riferimento può essere sostituita con un'immagine caricata da te, e il resto della pipeline la tratta esattamente come una scheda generata. È la procedura da usare per un personaggio che hai già progettato altrove.
Tecnicamente, la funzione di caricamento non si cura di cosa sia l'immagine, ma pubblicare video AI con le sembianze di una persona reale costituisce un problema legale nella maggior parte dei mercati, e la nostra guida alla conformità lo tratta come tale. Non forniamo uno strumento di face-swap e non ne consigliamo l'uso.
Non si rompe niente. Gli storyboard fanno riferimento alle risorse tramite identificatore, e la modifica del nome viene propagata a tutti i testi salvati contemporaneamente. Prima di settembre 2026 i riferimenti venivano associati per nome, ed è esattamente il problema che questa modifica ha risolto.
No. Associare un'immagine di riferimento a un segmento non cambia la tariffa al secondo: paghi una sola volta per ogni scheda di riferimento, poi non paghi nient'altro indipendentemente da quante inquadrature la usano. La consistenza qui è una scelta architetturale, non un servizio a pagamento extra.
No, e non dovresti farlo. Nel testo dell'inquadratura indichi il nome del personaggio; l'immagine di riferimento definisce il suo aspetto. Ripetere la descrizione fisica nel testo dell'inquadratura spinge il modello a basarsi sulle parole invece che sull'immagine, che è esattamente il problema di deriva che questo design elimina.
Sì: è esattamente a questo che servono le varianti di stato. Ogni aspetto ha la sua immagine di riferimento, e lo storyboard stabilisce per ogni segmento quale usare, con precisione sul singolo segmento e non sull'intero episodio.
Genera i personaggi una sola volta; ogni inquadratura successiva si basa su un'immagine, non su una descrizione.
Prova SceneMixer gratisPacchetti di crediti a partire da $1.49 · Pro $7.99/mese · Nessuna carta di credito richiesta per iniziare
Prezzi·Guide·Esempi·Supporto·Privacy·Termini·Note legali·Contatti·© 2026 SceneMixer