ИИ-сцены с несколькими персонажами
Обновлено 20 сентября 2026 г.

У сгенерированного видео есть характерная ошибка при съёмке больше одного человека в кадре: в нём появляется лицо, которого там быть не должно. Персонаж, упомянутый в тексте — на которого посмотрели, которому крикнули, о котором подумали — появляется на экране с лицом, придуманным на ходу, потому что модель не объяснили разницу между «присутствует» и «упомянут».
Поэтому список кадров прописывает это для каждого кадра отдельно. У каждого кадра есть явный список персонажей в кадре, и именно этот список — не проза, не финальное состояние предыдущего кадра — единственный фактор, который решает, чьи референсы подключать.
| Кто в кадре | Список для каждого кадра. Объединение по кадрам сегмента определяет, какие референсы отправляются вместе с ним. |
|---|---|
| Кто за кадром | Прописывается как направление — «в левую часть кадра», «взгляд в камеру» — а не как имя. Лицо не подключается. |
| Одиночные кадры | Явно помечаются, чтобы рендерер знал: в кадре один человек, не нужно придумывать ему компанию. |
| Кто говорит | Имя указывается для каждой реплики; у всех остальных в кадре помечается «губы сомкнуты», поэтому рот двигается только у говорящего. |
| Фоновая толпа | Объявленное состояние сцены, прописывается один раз в заголовке сегмента, либо отсутствует — никогда не выводится из фоновых звуков. |
| Практический предел | Четыре названных человека в кадре — точка, после которой качество падает. Список кадров обходит это ограничение, а не пытается пробиться сквозь него. |
Это измеримо, а не теоретически. В кадрах, где называли закадрового антагониста, в пяти из восьми рендеров появлялось не то лицо или лишний человек. Те же кадры, переписанные так, чтобы вместо имени было направление, дали ноль таких ошибок в двенадцати рендерах. Поэтому пайплайн переписывает их: в одиночном кадре персонаж, существующий только как направление взгляда или движения, превращается в пространственную фразу и убирается из списка присутствующих в кадре.
Та же логика работает и с мёртвыми: персонаж, упомянутый в этом сегменте только как тело, прописывается обычным существительным, а не как ссылка на персонажа, поэтому никто не подключает его референс и не ставит его на ноги.
Снять это можно ровно двумя способами, и список должен выбрать один: профильный двойной план или съёмка через плечо. Нельзя написать «А стоит лицом к Б, Б находится сзади на фоне, не в фокусе» — чтобы Б был вне глубины резкости А, А должен стоять к Б спиной, а такой позиции камеры в обычном среднем плане не существует. Если всё же попросить об этом, рендерер поставит одного человека лицом к камере, а второго — прямо за ним. Ось съёмки задаётся в первом кадре, где оба действительно находятся вместе в кадре.
Зал на триста гостей — это видимое состояние сцены, так оно и прописывается: строка в заголовке сегмента, где сказано, кто эти фоновые люди, где они и что делают. Это единообразно для всех сегментов в этой сцене. Без такой строки кадр не может ссылаться на толпу вообще, потому что «шум гостей» в звуковом оформлении — не визуальная инструкция, и рендерер, которому сказали только это, покажет гостей в одном кадре и пустой зал в следующем.
Когда толпа объявлена, инструкция для кадра меняется вместе с ней: толпа остаётся в глубине резкости, а список присутствующих в кадре по-прежнему считает только названных персонажей.
Ничего дополнительного — это свойства списка кадров, который оплачивается по длине скрипта по ставке 1 кредит за сто символов в доле эпизода. Референсы стоят по 7 кредитов каждый сверх 15 бесплатных в вашем первом проекте, а рендер начинается от 10 кредитов за секунду готового видео. Про то, как лица сохраняются от кадра к кадру, смотрите в разделе стабильность персонажей, а тарифы — на странице цен.
Языки
Каждый сериал ниже создан по одному и тому же пайплайну: актёры говорят на выбранном языке как на родном — интерфейс, рабочие документы и реплики на одном языке, без дубляжа. Откройте любой, чтобы послушать.
A Carta de LisboaPortuguêsРодная речь
윈터 프라미스한국어Родная речь
El Secreto de CostaEspañolРодная речь
浪人の誓い日本語Родная речь
Ikrar JakartaBahasa IndonesiaРодная речь
Зимняя коронаРусскийНа вашем языке
L’Héritier du DéfiléFrançaisРодная речь
Il Tavolo dell'OlivaItalianoРодная речь
De Vuurtoren van de FjordNederlandsРодная речь
العهد الصحراويالعربيةРодная речь
Çantasındaki SözleşmeTürkçeРодная речь
Die Istanbul-TäuschungDeutschРодная речь
Останній сигналУкраїнськаРодная речь
問劍青雲繁體中文Родная речь
The Last EnvelopeEnglishРодная речьЧетыре названных человека — практический предел, после которого идентичность начинает ломаться, и список кадров строится так, чтобы не выходить за него: массовые сцены снимаются одиночными планами и кадрами через плечо, а не широкими групповыми кадрами.
Это как раз та ошибка, которую предотвращает список присутствующих в кадре для каждого кадра. Персонаж, на которого только посмотрели или которому сказали что-то, прописывается как направление, а не как имя, и не попадает в список кадра — поэтому к нему не подключается референс и не придумывается лицо.
Да, в профильном двойном плане или через плечо. Не работает вариант, когда один стоит лицом к другому, а второй размыт на фоне: такое сочетание кадра и глубины резкости физически несогласованно, и если попросить об этом, получится человек, стоящий за спиной говорящего в камеру.
Они объявляются один раз в заголовке сегмента — кто это, где находятся, что делают — и остаются неизменными в рамках всей сцены. Если ничего не объявлено, в кадре нет толпы. Один только фоновый шум толпы не считается визуальной инструкцией.
Только указанный говорящий в каждой реплике. У всех остальных в кадре губы явно отмечены как сомкнутые — это не даёт слушателю беззвучно повторять диалог.
Сгенерируйте одну сцену с толпой и посчитайте лица.
Попробуйте SceneMixer бесплатноПакеты кредитов от $1.49 · Pro $7.99/мес · Карта не нужна для старта
Тарифы·Руководства·Примеры·Поддержка·Конфиденциальность·Условия·Правовая информация·Связаться с нами·© 2026 SceneMixer