
Dopo l’analisi, apri l’episodio nel Passaggio 3 e leggi la sua struttura: ogni blocco scena elenca le battute nel formato «personaggio: battuta».
Il riconoscimento vocale viene eseguito sull’audio di ogni singola inquadratura. Quello che viene rilevato viene passato alla descrizione dell’inquadratura come «queste parole sono state pronunciate qui»; il sistema di descrizione identifica quindi chi parla dai volti e inserisce la battuta nell’inquadratura. La musica sotto i dialoghi viene gestita correttamente; le urla in mezzo alla folla, gli accenti marcati e le battute molto sommesse sono i casi in cui il sistema fallisce, e in quei casi preferisce omettere invece di inventare. Le battute appaiono quindi nella struttura come in un copione: Scrivi i dialoghi in modo che vengano rilevati.

Lasciato a sé stesso, un modello di visione a cui si chiede «cosa viene detto qui» a volte sente e a volte no, sulla stessa inquadratura, e inventa battute plausibili quando non è sicuro. Le parole riconosciute, fissate nella descrizione, evitano entrambi i problemi: le stesse parole vengono usate ogni volta che l’inquadratura viene descritta.
L’analisi chiede una sola volta se il clip ha musica e di che tipo. Se sì, ogni segmento generato riporta un’indicazione musicale di una riga che la corrisponde, così i segmenti generati hanno musica dello stesso carattere; la traccia sorgente non viene mai usata. I suoni ambientali vengono annotati ma non riportati. Da dove viene la musica.
Viene scelta nella schermata di caricamento, con impostazione predefinita sulla lingua dell’interfaccia (il sito cinese è sempre in cinese), e rimane fissa una volta avviata l’analisi. Le battute ascoltate in un’altra lingua vengono tradotte in quella scelta. Non può essere modificata dopo per un remake, motivo per cui il Passaggio 1 non mostra il menu a discesa. Dopo l’analisi.
La struttura in sé non può essere modificata, e lo storyboard copia le sue battute parola per parola. Genera lo storyboard, poi apri il segmento a cui appartiene la battuta e aggiungila o correggila lì, indicando chi parla; una battuta assegnata alla persona sbagliata si corregge allo stesso modo. La modifica è gratuita. Genera lo storyboard.
| Nel clip | Nell’analisi | Nel tuo episodio |
|---|---|---|
| Una battuta pronunciata chiaramente | Riportata, con nome di chi parla | Una battuta nella struttura |
| Nessuno parla | Inquadratura segnata come silenziosa | Nessuna battuta |
| Dialogo poco chiaro | Omesso | Aggiungilo a mano nel segmento |
| Musica | Carattere annotato | Musica dello stesso carattere in ogni segmento |
| Suono ambientale | Annotato | Non riportato; lo storyboard ne crea uno proprio |
Il riconoscitore non è riuscito a capirla. Confrontala con il tuo clip e aggiungila nel segmento dopo aver creato lo storyboard.
No. Le voci provengono dalle impostazioni vocali del cast, come in qualsiasi progetto.
Sì; scegli la lingua dei dialoghi nella schermata di caricamento e le battute verranno tradotte durante l’analisi.
No. Il suo carattere viene descritto e i segmenti generano la propria musica.
Il rumore di gruppo viene trattato come suono di sfondo, non come dialogo.
Quello che viene detto nel clip è quello che dice il tuo episodio.
Aggiornato il 27 settembre 2026
Prezzi·Guide·Esempi·Supporto·Privacy·Termini·Note legali·Contatti·© 2026 SceneMixer