SceneMixer
Русский
Зарегистрироваться бесплатно

ИИ-сцены с несколькими персонажами

Генератор ИИ-сцен с несколькими персонажами

Обновлено 20 сентября 2026 г.

Короткий ответ: у каждого кадра есть явный список тех, кто в нём находится, и только по этому списку подключаются арты персонажей — поэтому тот, на кого просто посмотрели или кому сказали что-то, прописывается как направление, а не как имя, и никогда не появляется на экране с выдуманным лицом. Рот двигается только у названного говорящего. Фоновая толпа — это объявленное состояние сцены, либо её нет. Если в кадре больше четырёх названных персонажей, сцена разбивается на одиночные планы.
Кадр из «Нокаут в Ржавом Городе», AI-короткометражной дорамы, полностью сгенерированной SceneMixer (6 персонажей, 1 эпизод)
Пример: «Нокаут в Ржавом Городе» — Живописное аниме, 1 эпизод, полностью создано SceneMixer по сценарию · смотреть серии

Сложность в том, кто в кадре, а не сколько

У сгенерированного видео есть характерная ошибка при съёмке больше одного человека в кадре: в нём появляется лицо, которого там быть не должно. Персонаж, упомянутый в тексте — на которого посмотрели, которому крикнули, о котором подумали — появляется на экране с лицом, придуманным на ходу, потому что модель не объяснили разницу между «присутствует» и «упомянут».

Поэтому список кадров прописывает это для каждого кадра отдельно. У каждого кадра есть явный список персонажей в кадре, и именно этот список — не проза, не финальное состояние предыдущего кадра — единственный фактор, который решает, чьи референсы подключать.

Коротко

Как прописывается кадр с несколькими персонажами
Кто в кадреСписок для каждого кадра. Объединение по кадрам сегмента определяет, какие референсы отправляются вместе с ним.
Кто за кадромПрописывается как направление — «в левую часть кадра», «взгляд в камеру» — а не как имя. Лицо не подключается.
Одиночные кадрыЯвно помечаются, чтобы рендерер знал: в кадре один человек, не нужно придумывать ему компанию.
Кто говоритИмя указывается для каждой реплики; у всех остальных в кадре помечается «губы сомкнуты», поэтому рот двигается только у говорящего.
Фоновая толпаОбъявленное состояние сцены, прописывается один раз в заголовке сегмента, либо отсутствует — никогда не выводится из фоновых звуков.
Практический пределЧетыре названных человека в кадре — точка, после которой качество падает. Список кадров обходит это ограничение, а не пытается пробиться сквозь него.

Почему имя персонажа за кадром портит кадр

Это измеримо, а не теоретически. В кадрах, где называли закадрового антагониста, в пяти из восьми рендеров появлялось не то лицо или лишний человек. Те же кадры, переписанные так, чтобы вместо имени было направление, дали ноль таких ошибок в двенадцати рендерах. Поэтому пайплайн переписывает их: в одиночном кадре персонаж, существующий только как направление взгляда или движения, превращается в пространственную фразу и убирается из списка присутствующих в кадре.

Та же логика работает и с мёртвыми: персонаж, упомянутый в этом сегменте только как тело, прописывается обычным существительным, а не как ссылка на персонажа, поэтому никто не подключает его референс и не ставит его на ноги.

Два человека друг напротив друга

Снять это можно ровно двумя способами, и список должен выбрать один: профильный двойной план или съёмка через плечо. Нельзя написать «А стоит лицом к Б, Б находится сзади на фоне, не в фокусе» — чтобы Б был вне глубины резкости А, А должен стоять к Б спиной, а такой позиции камеры в обычном среднем плане не существует. Если всё же попросить об этом, рендерер поставит одного человека лицом к камере, а второго — прямо за ним. Ось съёмки задаётся в первом кадре, где оба действительно находятся вместе в кадре.

Толпа либо объявлена, либо её нет

Зал на триста гостей — это видимое состояние сцены, так оно и прописывается: строка в заголовке сегмента, где сказано, кто эти фоновые люди, где они и что делают. Это единообразно для всех сегментов в этой сцене. Без такой строки кадр не может ссылаться на толпу вообще, потому что «шум гостей» в звуковом оформлении — не визуальная инструкция, и рендерер, которому сказали только это, покажет гостей в одном кадре и пустой зал в следующем.

Когда толпа объявлена, инструкция для кадра меняется вместе с ней: толпа остаётся в глубине резкости, а список присутствующих в кадре по-прежнему считает только названных персонажей.

Что система не будет делать

Сколько это стоит

Ничего дополнительного — это свойства списка кадров, который оплачивается по длине скрипта по ставке 1 кредит за сто символов в доле эпизода. Референсы стоят по 7 кредитов каждый сверх 15 бесплатных в вашем первом проекте, а рендер начинается от 10 кредитов за секунду готового видео. Про то, как лица сохраняются от кадра к кадру, смотрите в разделе стабильность персонажей, а тарифы — на странице цен.

Языки

Родная речь на 15 языках

Каждый сериал ниже создан по одному и тому же пайплайну: актёры говорят на выбранном языке как на родном — интерфейс, рабочие документы и реплики на одном языке, без дубляжа. Откройте любой, чтобы послушать.

Посмотреть все 15 языков

Часто задаваемые вопросы

Сколько персонажей может быть в одном кадре?

Четыре названных человека — практический предел, после которого идентичность начинает ломаться, и список кадров строится так, чтобы не выходить за него: массовые сцены снимаются одиночными планами и кадрами через плечо, а не широкими групповыми кадрами.

Почему персонаж, которого я просто упомянул, появился на экране?

Это как раз та ошибка, которую предотвращает список присутствующих в кадре для каждого кадра. Персонаж, на которого только посмотрели или которому сказали что-то, прописывается как направление, а не как имя, и не попадает в список кадра — поэтому к нему не подключается референс и не придумывается лицо.

Могут ли два персонажа разговаривать лицом к лицу?

Да, в профильном двойном плане или через плечо. Не работает вариант, когда один стоит лицом к другому, а второй размыт на фоне: такое сочетание кадра и глубины резкости физически несогласованно, и если попросить об этом, получится человек, стоящий за спиной говорящего в камеру.

Как работают фоновые статисты?

Они объявляются один раз в заголовке сегмента — кто это, где находятся, что делают — и остаются неизменными в рамках всей сцены. Если ничего не объявлено, в кадре нет толпы. Один только фоновый шум толпы не считается визуальной инструкцией.

Кто двигает губами?

Только указанный говорящий в каждой реплике. У всех остальных в кадре губы явно отмечены как сомкнутые — это не даёт слушателю беззвучно повторять диалог.

В кадре нет никого, кого вы не добавили в каст

Сгенерируйте одну сцену с толпой и посчитайте лица.

Попробуйте SceneMixer бесплатно

Пакеты кредитов от $1.49 · Pro $7.99/мес · Карта не нужна для старта

Тарифы·Руководства·Примеры·Поддержка·Конфиденциальность·Условия·Правовая информация·Связаться с нами·© 2026 SceneMixer