SceneMixer
Українська
Зареєструватися безкоштовно

AI-сцени з кількома персонажами

Генератор AI-сцен із кількома персонажами

Оновлено 20 вересня 2026 р.

Коротка відповідь: для кожного кадру є чіткий список тих, хто в ньому присутній, і саме за цим списком підвантажуються сетингові зображення персонажів. Тому той, на кого просто подивилися чи до кого звернулися, описується як вказівка, а не як ім’я — і не з’являється на екрані з вигаданим обличчям. Рухається рот лише у названого мовця. Фонові натовпи або явно оголошуються як стан сцени, або відсутні. Якщо в кадрі більше чотирьох названих персонажів, сцена розбивається на поодинокі кадри.
Кадр з «Нокаут у Ржавому місті», AI-короткометражної драми, згенерованої повністю в SceneMixer (6 персонажів, 1 епізод)
Зразок: «Нокаут у Ржавому місті» — Живописне аніме, 1 епізод, створено повністю в SceneMixer зі сценарію · дивитися серії

Складність — у тому, хто в кадрі, а не в кількості

Згенероване відео має типову помилку, коли в кадрі більше однієї людини: модель додає обличчя, якого там не має бути. Персонаж, згаданий у тексті — на якого подивилися, кому крикнули, про кого подумали — з’являється на екрані з обличчям, вигаданим на ходу, бо нічого не пояснює моделі різницю між «присутній» і «згаданий».

Тому список кадрів фіксує це окремо для кожного знімка. Кожен кадр має чіткий перелік персонажів у кадрі, і саме цей список — а не текст опису чи кінцевий стан попереднього кадру — є єдиним джерелом, за яким вирішується, чиї сетингові зображення підключати.

Коротко

Як задається кадр із кількома персонажами
Хто в кадріСписок для кожного кадру. Об’єднання списків усіх кадрів у сегменті визначає, які сетингові арти надсилати разом із ним.
Хто за кадромОписується як вказівка — «у напрямку лівого краю кадру», «погляд у камеру» — а не як ім’я. Жодне обличчя не підвантажується.
Поодинокі кадриЯвно позначаються, щоб рендерер знав: у кадрі одна людина, і не вигадував їй співрозмовників.
Хто говоритьВказується поіменно для кожної репліки; усі інші в кадрі позначаються як такі, що мають закриті губи, тому рот рухається лише у мовця.
Фоновий натовпЯвно оголошений стан сцени, який прописується один раз у заголовку сегмента, або відсутній — ніколи не випливає з фонового звуку.
Практична межаЧотири названі людини в одному кадрі — це точка, після якої якість падає. Список кадрів обходить цю межу, а не намагається пройти крізь неї.

Чому згадка імені закадрового персонажа псує кадр

Це вимірювана проблема, а не теоретична. У кадрах, де називали ім’я закадрового антагоніста, у п’яти з восьми рендерів з’являлося неправильне обличчя або зайва людина. Ті самі кадри, переписані так, щоб замість імені була вказівка напрямку, дали нуль таких помилок на дванадцять рендерів. Тому пайплайн переписує їх: у поодинокому кадрі персонаж, який існує лише як напрямок погляду чи руху, перетворюється на просторову фразу і видаляється зі списку присутніх у кадрі.

Та сама логіка працює для померлих: персонаж, якого в цьому сегменті згадано лише як тіло, описується звичайним іменником, а не як посилання на персонажа, тому ніхто не підвантажує його сетинг і не ставить його на ноги.

Двоє людей одне навпроти одного

Є рівно два способи зняти таку сцену, і список має обрати один: профільний двійковий кадр або зйомка через плече. Не можна написати «А стоїть обличчям до Б, а Б розмито позаду на фоні» — щоб Б потрапляв у глибину різкості А, А має стояти до Б спиною, а такого положення камери у звичайному середньому плані не існує. Якщо попросити саме так, рендерер поставить одну людину обличчям до камери, а іншу — прямо за нею. Вісь зйомки фіксується в першому кадрі, де обидва персонажі справді перебувають разом у кадрі.

Натовп або оголошується, або відсутній

Зала на триста гостей — це видимий стан сцени, тому він так і прописується: один рядок у заголовку сегмента, хто ці фонові люди, де вони і що роблять. Це однаково для всіх сегментів у цій сцені. Без такого рядка кадр не може посилатися на натовп, бо «гомін гостей» у фоновому аудіо — це не візуальна інструкція; якщо рендереру сказати лише це, в одному кадрі будуть гості, а в наступному — порожня зала.

Коли натовп оголошено, інструкція для кадру змінюється відповідно: натовп залишається в межах глибини різкості, а список присутніх у кадрі все ще рахує лише названих персонажів.

Що система не робить

Скільки це коштує

Нічого додатково — це властивості списку кадрів, який оплачується за довжиною сценарію за ставкою 1 кредит за сто символів частки епізоду. Сетингові арти коштують 7 кредитів кожен після 15 безкоштовних у вашому першому проєкті, а рендер починається від 10 кредитів за секунду готового відео. Про те, як обличчя залишаються однаковими між кадрами, дивіться у розділі сталість персонажів, а актуальні тарифи — на сторінці цін.

Мови

Рідна мова діалогів 15 мовами

Кожен серіал нижче створено за тим самим пайплайном: актори розмовляють відповідною мовою як носії — інтерфейс, робочі документи та репліки однією мовою, без дубляжу. Відкрийте, щоб послухати.

Переглянути всі 15 мов

Поширені запитання

Скільки персонажів може бути в одному кадрі?

Чотири названі людини — практична межа, після якої впізнаваність починає псуватися, і список кадрів будується так, щоб не перевищувати її: масові сцени покриваються поодинокими кадрами та кадрами через плече, а не широкими груповими планами.

Чому персонаж, якого я просто згадав, з’явився на екрані?

Це якраз та помилка, яку запобігає список присутніх у кадрі для кожного знімка. Персонаж, на якого лише подивилися чи до якого звернулися, описується як вказівка, а не як ім’я, і не потрапляє до списку в кадрі — тому для нього не підвантажується сетинг і не вигадується обличчя.

Чи можуть два персонажі розмовляти віч-на-віч?

Так — у профільному двійковому кадрі або у кадрі через плече. Не працює варіант, коли один стоїть обличчям до іншого, а інший розмито на фоні: таке поєднання кадрування та глибини різкості фізично неузгоджене, і якщо попросити про це, вийде людина, що стоїть за спиною того, хто говорить у камеру.

Як працюють фонові масовки?

Їх оголошують один раз у заголовку сегмента — хто вони, де перебувають і що роблять — і вони залишаються незмінними впродовж усієї сцени. Якщо нічого не оголошено, кадр не містить натовпу. Сам по собі фоновий шум натовпу не вважається візуальною вказівкою.

Хто рухає ротом?

Тільки названий промовець кожної репліки. Усі інші в кадрі явно позначені із закритими губами — саме це не дає слухачеві беззвучно повторювати діалог.

У кадрі немає нікого, кого ви не додали до складу

Згенеруйте одну сцену з натовпом і порахуйте обличчя.

Спробуйте SceneMixer безкоштовно

Пакети кредитів від $1.49 · Pro $7.99/міс · Кредитна картка не потрібна для початку

Ціни·Посібники·Зразки·Підтримка·Конфіденційність·Умови·Правова інформація·Контакти·© 2026 SceneMixer