
После считывания откройте серию на шаге 3 и просмотрите её структуру: в каждом блоке сцены реплики перечислены в формате «говорящий: реплика».
Распознавание речи запускается для аудио каждого отдельного кадра. То, что оно услышало, передаётся описателю кадра как пометка «здесь были сказаны эти слова»; после этого описатель определяет говорящего по лицам и вписывает реплику в кадр. Музыка под речью обрабатывается корректно; сбои возникают на криках поверх толпы, при сильном акценте и очень тихих репликах — в таких случаях они пропускаются, а не придумываются. Реплики появляются в структуре как в сценарии: Пишите диалоги так, чтобы они распознавались.

Если оставить всё на усмотрение зрительной модели, на вопрос «что здесь сказано» она на одном и том же кадре то услышит речь, то нет, а при неуверенности придумает правдоподобные реплики. Распознанные слова, закреплённые в описании, исключают обе проблемы: при каждом описании кадра используются одни и те же слова.
При считывании один раз проверяется, есть ли в клипе музыка и какая. Если есть, каждый сгенерированный вами сегмент получает однострочное задание на музыку под неё, чтобы в готовых сегментах была музыка того же характера; сам исходный трек не используется. Фоновые шумы отмечаются, но не переносятся. Откуда берётся музыка.
Выбирается на экране загрузки, по умолчанию соответствует языку интерфейса (китайская версия сайта всегда работает на китайском), и фиксируется с началом считывания. Реплики, услышанные на другом языке, переводятся на него. Для ремейка его нельзя изменить после начала, поэтому на шаге 1 нет соответствующего выпадающего списка. После считывания.
Саму структуру редактировать нельзя, а раскадровка копирует из неё реплики слово в слово. Сгенерируйте раскадровку, потом откройте сегмент, к которому относится реплика, и добавьте или исправьте её там вместе с указанием говорящего; реплику, приписанную не тому человеку, исправляют так же. Редактирование бесплатно. Сгенерировать раскадровку.
| В клипе | При считывании | В вашей серии |
|---|---|---|
| Чётко произнесённая реплика | Цитируется, говорящий определяется | Реплика в структуре серии |
| Никто не говорит | Кадр помечается как тихий | Реплики нет |
| Неразборчивая речь | Пропускается | Добавьте в сегмент вручную |
| Музыка | Характер отмечается | Музыка того же характера в каждом сегменте |
| Фоновые шумы | Отмечаются | Не переносятся; в раскадровке прописываются свои |
Распознаватель не смог её разобрать. Сравните с вашим клипом и добавьте в сегмент после создания раскадровки.
Нет. Голоса берутся из настроек голосов персонажей, как в любом проекте.
Да; выберите язык диалогов на экране загрузки, и реплики переведутся при считывании.
Нет. Описывается её характер, и сегменты генерируют собственную музыку.
Шум группы считается фоновым звуком, а не диалогом.
Что было сказано в клипе — то и говорится в вашей серии.
Обновлено 27 сентября 2026 г.
Тарифы·Руководства·Примеры·Поддержка·Конфиденциальность·Условия·Правовая информация·Связаться с нами·© 2026 SceneMixer