AI-сцени з кількома персонажами
Оновлено 20 вересня 2026 р.

Згенероване відео має типову помилку, коли в кадрі більше однієї людини: модель додає обличчя, якого там не має бути. Персонаж, згаданий у тексті — на якого подивилися, кому крикнули, про кого подумали — з’являється на екрані з обличчям, вигаданим на ходу, бо нічого не пояснює моделі різницю між «присутній» і «згаданий».
Тому список кадрів фіксує це окремо для кожного знімка. Кожен кадр має чіткий перелік персонажів у кадрі, і саме цей список — а не текст опису чи кінцевий стан попереднього кадру — є єдиним джерелом, за яким вирішується, чиї сетингові зображення підключати.
| Хто в кадрі | Список для кожного кадру. Об’єднання списків усіх кадрів у сегменті визначає, які сетингові арти надсилати разом із ним. |
|---|---|
| Хто за кадром | Описується як вказівка — «у напрямку лівого краю кадру», «погляд у камеру» — а не як ім’я. Жодне обличчя не підвантажується. |
| Поодинокі кадри | Явно позначаються, щоб рендерер знав: у кадрі одна людина, і не вигадував їй співрозмовників. |
| Хто говорить | Вказується поіменно для кожної репліки; усі інші в кадрі позначаються як такі, що мають закриті губи, тому рот рухається лише у мовця. |
| Фоновий натовп | Явно оголошений стан сцени, який прописується один раз у заголовку сегмента, або відсутній — ніколи не випливає з фонового звуку. |
| Практична межа | Чотири названі людини в одному кадрі — це точка, після якої якість падає. Список кадрів обходить цю межу, а не намагається пройти крізь неї. |
Це вимірювана проблема, а не теоретична. У кадрах, де називали ім’я закадрового антагоніста, у п’яти з восьми рендерів з’являлося неправильне обличчя або зайва людина. Ті самі кадри, переписані так, щоб замість імені була вказівка напрямку, дали нуль таких помилок на дванадцять рендерів. Тому пайплайн переписує їх: у поодинокому кадрі персонаж, який існує лише як напрямок погляду чи руху, перетворюється на просторову фразу і видаляється зі списку присутніх у кадрі.
Та сама логіка працює для померлих: персонаж, якого в цьому сегменті згадано лише як тіло, описується звичайним іменником, а не як посилання на персонажа, тому ніхто не підвантажує його сетинг і не ставить його на ноги.
Є рівно два способи зняти таку сцену, і список має обрати один: профільний двійковий кадр або зйомка через плече. Не можна написати «А стоїть обличчям до Б, а Б розмито позаду на фоні» — щоб Б потрапляв у глибину різкості А, А має стояти до Б спиною, а такого положення камери у звичайному середньому плані не існує. Якщо попросити саме так, рендерер поставить одну людину обличчям до камери, а іншу — прямо за нею. Вісь зйомки фіксується в першому кадрі, де обидва персонажі справді перебувають разом у кадрі.
Зала на триста гостей — це видимий стан сцени, тому він так і прописується: один рядок у заголовку сегмента, хто ці фонові люди, де вони і що роблять. Це однаково для всіх сегментів у цій сцені. Без такого рядка кадр не може посилатися на натовп, бо «гомін гостей» у фоновому аудіо — це не візуальна інструкція; якщо рендереру сказати лише це, в одному кадрі будуть гості, а в наступному — порожня зала.
Коли натовп оголошено, інструкція для кадру змінюється відповідно: натовп залишається в межах глибини різкості, а список присутніх у кадрі все ще рахує лише названих персонажів.
Нічого додатково — це властивості списку кадрів, який оплачується за довжиною сценарію за ставкою 1 кредит за сто символів частки епізоду. Сетингові арти коштують 7 кредитів кожен після 15 безкоштовних у вашому першому проєкті, а рендер починається від 10 кредитів за секунду готового відео. Про те, як обличчя залишаються однаковими між кадрами, дивіться у розділі сталість персонажів, а актуальні тарифи — на сторінці цін.
Мови
Кожен серіал нижче створено за тим самим пайплайном: актори розмовляють відповідною мовою як носії — інтерфейс, робочі документи та репліки однією мовою, без дубляжу. Відкрийте, щоб послухати.
A Carta de LisboaPortuguêsРідномовні діалоги
윈터 프라미스한국어Рідномовні діалоги
El Secreto de CostaEspañolРідномовні діалоги
浪人の誓い日本語Рідномовні діалоги
Ikrar JakartaBahasa IndonesiaРідномовні діалоги
Зимняя коронаРусскийРідномовні діалоги
L’Héritier du DéfiléFrançaisРідномовні діалоги
Il Tavolo dell'OlivaItalianoРідномовні діалоги
De Vuurtoren van de FjordNederlandsРідномовні діалоги
العهد الصحراويالعربيةРідномовні діалоги
Çantasındaki SözleşmeTürkçeРідномовні діалоги
Die Istanbul-TäuschungDeutschРідномовні діалоги
Останній сигналУкраїнськаВашою мовою
問劍青雲繁體中文Рідномовні діалоги
The Last EnvelopeEnglishРідномовні діалогиЧотири названі людини — практична межа, після якої впізнаваність починає псуватися, і список кадрів будується так, щоб не перевищувати її: масові сцени покриваються поодинокими кадрами та кадрами через плече, а не широкими груповими планами.
Це якраз та помилка, яку запобігає список присутніх у кадрі для кожного знімка. Персонаж, на якого лише подивилися чи до якого звернулися, описується як вказівка, а не як ім’я, і не потрапляє до списку в кадрі — тому для нього не підвантажується сетинг і не вигадується обличчя.
Так — у профільному двійковому кадрі або у кадрі через плече. Не працює варіант, коли один стоїть обличчям до іншого, а інший розмито на фоні: таке поєднання кадрування та глибини різкості фізично неузгоджене, і якщо попросити про це, вийде людина, що стоїть за спиною того, хто говорить у камеру.
Їх оголошують один раз у заголовку сегмента — хто вони, де перебувають і що роблять — і вони залишаються незмінними впродовж усієї сцени. Якщо нічого не оголошено, кадр не містить натовпу. Сам по собі фоновий шум натовпу не вважається візуальною вказівкою.
Тільки названий промовець кожної репліки. Усі інші в кадрі явно позначені із закритими губами — саме це не дає слухачеві беззвучно повторювати діалог.
Згенеруйте одну сцену з натовпом і порахуйте обличчя.
Спробуйте SceneMixer безкоштовноПакети кредитів від $1.49 · Pro $7.99/міс · Кредитна картка не потрібна для початку
Ціни·Посібники·Зразки·Підтримка·Конфіденційність·Умови·Правова інформація·Контакти·© 2026 SceneMixer