
Après une analyse, ouvrez l’épisode à l’étape 3 et lisez son plan : chaque bloc de scène liste ses répliques sous la forme « intervenant : réplique ».
La reconnaissance vocale s’exécute sur l’audio propre à chaque plan. Ce qu’elle entend est transmis à la description du plan comme « ces mots ont été prononcés ici » ; le descripteur identifie ensuite l’intervenant à partir des visages et inscrit la réplique dans le plan. La musique sous les dialogues est prise en charge ; les cris dans une foule, les accents très marqués et les répliques très silencieuses sont des cas où le système échoue, et ces passages sont omis plutôt qu’inventés. Les répliques apparaissent ensuite dans le plan comme dans un script : Écrire des dialogues qui sont bien détectés.

Livré à lui-même, un modèle de vision à qui l’on demande « qu’est-ce qui est dit ici » entendra parfois la chose, parfois non, sur le même plan, et inventera des répliques plausibles en cas d’incertitude. Les mots reconnus, intégrés à la description, empêchent ces deux problèmes : les mêmes mots sont utilisés à chaque fois que le plan est décrit.
L’analyse détermine une seule fois si le clip contient de la musique et de quel type. Si c’est le cas, chaque segment que vous générez comporte une note d’intention musicale d’une ligne correspondante, afin que les segments générés aient une musique du même caractère ; la piste source elle-même n’est jamais utilisée. Les sons ambiants sont notés mais pas repris. D’où vient la musique.
Choisie sur l’écran de téléversement, avec pour défaut la langue de votre interface (le site chinois est toujours en chinois), et fixe une fois l’analyse lancée. Les répliques entendues dans une autre langue sont traduites dans celle-ci. Elle ne peut pas être modifiée par la suite pour un remake, c’est pourquoi l’étape 1 ne propose pas de menu déroulant. Après l’analyse.
Le plan lui-même ne peut pas être modifié, et le storyboard reprend ses répliques mot pour mot. Générez le storyboard, puis ouvrez le segment auquel la réplique appartient et ajoutez-la ou corrigez-la là, avec son intervenant ; une réplique attribuée à la mauvaise personne se corrige de la même façon. La modification est gratuite. Générer le storyboard.
| Dans le clip | Dans l’analyse | Dans votre épisode |
|---|---|---|
| Une réplique parlée clairement | Citée, intervenant identifié | Une réplique dans le plan |
| Personne ne parle | Plan marqué silencieux | Pas de réplique |
| Parole peu claire | Laissée de côté | Ajoutez-la manuellement dans le segment |
| Musique | Caractère noté | Musique de même caractère dans chaque segment |
| Son ambiant | Noté | Non repris ; le storyboard crée le sien |
Le système de reconnaissance n’a pas pu la déchiffrer. Comparez avec votre clip et ajoutez-la dans le segment une fois que le storyboard existe.
Non. Les voix proviennent des paramètres vocaux de la distribution, comme dans n’importe quel projet.
Oui ; choisissez la langue des dialogues sur l’écran de téléversement et les répliques sont traduites lors de l’analyse.
Non. Son caractère est décrit et les segments génèrent leur propre musique.
Le bruit de groupe est traité comme un son d’arrière-plan, pas comme un dialogue.
Mis à jour le 27 septembre 2026
Tarifs·Guides·Exemples·Assistance·Confidentialité·Conditions·Mentions légales·Contact·© 2026 SceneMixer