Generatore di shot list AI
Aggiornato il 20 settembre 2026

La maggior parte degli strumenti AI per le shot list restituisce una tabella. Devi comunque creare ogni scatto in un altro strumento, e sperare che il risultato corrisponda a quanto scritto nella tabella. Qui la shot list è l'input: ogni segmento viene generato dal proprio testo, usando le concept sheet di personaggi e luoghi nominati in quel testo. Se modifichi una riga della lista, viene rigenerato solo quel segmento. Questa sola differenza determina tutto il resto di questa pagina: la lista deve essere abbastanza precisa da essere eseguita, non solo leggibile.
L'unità è un segmento di 4–15 secondi, che corrisponde anche a una generazione. Al suo interno ci sono i singoli scatti. Ogni segmento si apre con un'intestazione che definisce i dati di cui una telecamera avrebbe bisogno prima di iniziare a girare:
| Luogo | Un riferimento a un luogo nella libreria di asset del progetto, non una nuova descrizione — così due segmenti nella stessa stanza sono effettivamente nella stessa stanza. |
|---|---|
| Ora e meteo | Dichiarati una volta per segmento. L'illuminazione deriva da questi dati più il plate del luogo, invece di essere reinventata per ogni scatto. |
| Arredamento del set e oggetti di scena | Cosa si trova nello spazio e quali oggetti di scena sono in uso. Gli oggetti elencati qui sono quelli le cui concept sheet vengono associate al segmento. |
| Stato del fotogramma iniziale | Il primo fotogramma, descritto come un fermo immagine: tipo di inquadratura, chi è presente, quale postura ha. Tutto ciò che non è visibile in quel primo fotogramma non va indicato qui. |
| Persone sullo sfondo | Presenti solo quando la scena ha davvero una folla. Dichiarate una sola volta, nell'intestazione, così non compaiono e scompaiono a intermittenza tra gli scatti dello stesso luogo. |
Non sono preferenze di stile. Ognuna è stata aggiunta dopo aver visto i video generati rompersi nello stesso modo più volte.
Dopo che il modello ha scritto la lista, viene eseguito un passaggio di correzioni deterministiche prima del salvataggio: le durate degli scatti vengono riconciliate con il segmento, il tipo di inquadratura iniziale viene allineato al primo scatto, le bocche di chi non parla vengono chiuse, i riferimenti ad armi e contatti vengono resi specifici, le note di bozza residue vengono rimosse. Un secondo passaggio chiede allo stesso modello di riscrivere solo le righe specifiche che non hanno superato un controllo, mai l'intera lista.
Nei progetti sulla piattaforma, l'episodio mediano è di sette segmenti, e il segmento mediano dura quattordici secondi — quindi la shot list di un episodio tipico copre circa cento secondi di tempo sullo schermo, con il numero di scatti necessario a quei sette segmenti. Generare la lista di un episodio richiede in media circa 1 minuto e 54 secondi, calcolato su tutte le liste generate con successo su scenemixer.com nei trenta giorni precedenti al 20 settembre 2026.
Ogni riga della lista è testo modificabile, e modificare non costa nulla — gli unici eventi fatturati sono le chiamate al modello. Questa asimmetria è voluta, perché cambia il modo di lavorare: correggere uno scatto a mano e renderizzare di nuovo solo quel segmento è economico, mentre chiedere al modello una nuova lista dell'intero episodio costa esattamente quanto la prima e cancella tutte le modifiche manuali in quell'episodio. Per piccole correzioni, modifica. Per un approccio davvero diverso all'episodio, rigenera.
Le shot list vengono fatturate per episodio, in base alla lunghezza del testo dello script coperto da quell’episodio: 1 credit ogni 333 caratteri di testo in inglese, alla stessa tariffa sia per la prima generazione sia per le riesecuzioni. L’analisi dello script, che produce il cast e la suddivisione per episodio su cui si basa la lista, costa 4 credit ogni 3,333 caratteri e viene eseguita una sola volta per l’intero caricamento. Nel primo progetto la shot list dell’episodio 1 è gratuita, e ogni account inizia con 50 credit. Il rendering delle inquadrature è separato, a partire da 10 credit al secondo di output. La tabella completa è sulla pagina dei prezzi.
La durata dei dialoghi viene calcolata per ogni lingua, così un’inquadratura è abbastanza lunga per la battuta che contiene, indipendentemente dalla lingua in cui è scritta. La lingua dei dialoghi viene scelta prima dell’analisi e viene generata nativamente, non doppiata in un secondo momento; tutte le serie qui sotto sono state prodotte in questo modo.
Lingue
Ogni serie qui sotto è stata prodotta con la stessa pipeline, con il cast che parla la lingua in modo nativo: interfaccia, documenti di lavoro e battute sono tutti nella stessa lingua, niente doppiaggio. Aprila per ascoltarla.
A Carta de LisboaPortuguêsDialoghi nativi
윈터 프라미스한국어Dialoghi nativi
El Secreto de CostaEspañolDialoghi nativi
浪人の誓い日本語Dialoghi nativi
Ikrar JakartaBahasa IndonesiaDialoghi nativi
Зимняя коронаРусскийDialoghi nativi
L’Héritier du DéfiléFrançaisDialoghi nativi
Il Tavolo dell'OlivaItalianoNella tua lingua
De Vuurtoren van de FjordNederlandsDialoghi nativi
العهد الصحراويالعربيةDialoghi nativi
Çantasındaki SözleşmeTürkçeDialoghi nativi
Die Istanbul-TäuschungDeutschDialoghi nativi
Останній сигналУкраїнськаDialoghi nativi
問劍青雲繁體中文Dialoghi nativi
The Last EnvelopeEnglishDialoghi nativiAl momento no. La lista vive nell’editor perché è lì che viene eseguita: è al contempo il documento di produzione e l’input per il rendering. Puoi copiare il testo di ogni segmento, e l’intera lista è in testo semplice, non in un formato proprietario.
Sì. Il testo di ogni segmento è modificabile, e puoi inserire, duplicare o eliminare segmenti. In ogni caso, quello che il sistema mette a disposizione è il collegamento alla libreria di asset: nominare un personaggio in un’inquadratura è il modo per associare la sua reference art al rendering.
Inserisce il movimento quando questo serve al ritmo della scena — un push in, un’orbita lenta, una ripresa a mano libera in seguimento — e lo evita quando un’inquadratura fissa è più efficace. Evita deliberatamente i movimenti complessi che i modelli video attuali trasformano in distorsioni, e non usa il gergo tecnico a cui rispondevano i modelli immagine di generazioni precedenti.
Le inquadrature con dialoghi vengono calibrate sulla battuta stessa, a una velocità di tre parole al secondo per l’inglese, con una durata minima per fare in modo che le battute molto corte abbiano comunque spazio. Le inquadrature senza dialoghi prendono la loro durata da quello che deve succedere al loro interno. Le durate delle inquadrature di un segmento vengono poi riallineate alla durata totale del segmento prima che la lista venga salvata; un segmento che supera la durata prevista viene diviso in corrispondenza di un confine tra inquadrature, invece di essere compresso.
Sì. L’analisi e la shot list sono acquisti separati rispetto al rendering, e non c’è nessun obbligo di effettuare il rendering. C’è chi usa la pipeline anche in questo modo: si carica uno script, si ottiene una shot list strutturata, e poi si girano le riprese in modo tradizionale.
Incolla uno script e leggi la lista del primo episodio.
Prova SceneMixer gratisPacchetti di credit a partire da $1.49 · Pro $7.99/mese · Nessuna carta di credito per iniziare
Prezzi·Guide·Esempi·Supporto·Privacy·Termini·Note legali·Contatti·© 2026 SceneMixer