AI 다인물 장면
2026년 9월 20일 업데이트

생성형 영상은 한 숏에 두 명 이상이 나올 때 특정한 오류를 냅니다. 바로 없어야 할 얼굴을 집어넣는 것입니다. 텍스트에서 언급된 사람—쳐다본 대상, 소리친 상대, 떠올린 인물—이 그 자리에서 만들어낸 얼굴을 달고 화면에 나타나는데, 모델이 '현재 화면에 있음'과 '언급됨'의 차이를 전달받지 못했기 때문입니다.
그래서 숏 목록은 숏마다 이를 명시합니다. 각 숏에는 화면에 어떤 캐릭터가 있는지 적힌 명시적 목록이 붙으며, 이 목록이—산문도, 이전 숏의 마지막 상태도 아닌—누구의 설정화를 연결할지 유일하게 결정합니다.
| 화면 속 인물 | 숏별 목록입니다. 한 세그먼트 내 모든 숏의 목록을 합쳐서 해당 세그먼트에 함께 보낼 설정화를 정합니다. |
|---|---|
| 화면 밖 인물 | 이름이 아닌 연출 지시—'화면 왼쪽을 향해', '카메라로 시선 맞춤'—로 적습니다. 얼굴은 연결되지 않습니다. |
| 1인 숏 | 명시적으로 표시해서, 렌더러가 화면에 한 사람만 있다고 인식하고 동행 인물을 만들어내지 않도록 합니다. |
| 말하는 사람 | 대사 줄마다 이름을 지정합니다. 화면 속 다른 모든 인물은 입을 다문 상태로 표시해, 말하는 사람의 입만 움직이도록 합니다. |
| 배경 군중 | 세그먼트 헤더에 한 번 적어 장면의 상태로 선언하거나, 아예 넣지 않습니다. 환경음으로 암시하지 않습니다. |
| 실질적인 상한 | 한 화면에 이름 있는 인물 4명을 넘어가면 품질이 떨어지기 시작합니다. 숏 목록은 이를 뚫고 가는 대신 우회해서 구성합니다. |
이것은 이론이 아니라 측정 가능한 결과입니다. 화면 밖 적대자에게 이름을 붙인 숏은 8번 렌더링 중 5번에서 잘못된 얼굴이나 엉뚱한 사람이 추가로 나왔습니다. 같은 숏에서 이름 대신 방향 지시로 고쳐 쓴 버전은 12번 렌더링에서 해당 오류가 0건이었습니다. 그래서 파이프라인은 이를 재작성합니다: 1인 숏에서 시선 방향이나 이동 방향으로만 존재하는 인물은 공간적 표현으로 바꾸고 화면 목록에서 제거합니다.
같은 논리가 죽은 인물에도 적용됩니다: 이 세그먼트에서 시체로만 언급되는 캐릭터는 캐릭터 참조가 아닌 평범한 명사로 적어서, 아무도 설정화를 붙여 그 사람을 일어서게 하지 않도록 합니다.
이를 찍는 방식은 정확히 두 가지뿐이며, 목록에서 둘 중 하나를 골라야 합니다: 측면 2인 숏, 혹은 숄더 숏. 여기서 쓸 수 없는 표현은 “A가 B를 마주 보고, B는 배경에서 초점이 흐릿하게 뒤에 있다”는 것입니다—B가 A의 심도 밖에 있으려면 A가 B에게 등을 보여야 하는데, 일반적인 미디엄 숏에는 그런 카메라 위치가 존재하지 않습니다. 억지로 요청하면 렌더러는 한 사람은 카메라를 정면으로 보고 다른 한 사람은 그 뒤에 서 있는 모습을 내놓습니다. 두 사람이 실제로 함께 화면에 나오는 첫 번째 숏에서 축이 정해집니다.
손님 300명이 있는 방은 장면의 눈에 보이는 상태이므로 그렇게 적습니다—세그먼트 헤더에 배경 인물이 누구이고 어디에 있으며 무엇을 하는지 적는 한 줄을 넣습니다. 해당 장면의 모든 세그먼트에 일관되게 적용됩니다. 그 줄이 없으면 숏에서 군중을 전혀 언급할 수 없습니다. 환경음에 “손님들의 웅성거림”이 있다는 건 시각적 지시가 아니기 때문에, 그것만 알려준 렌더러는 한 숏에는 손님을 넣고 다음 숏에는 텅 빈 홀을 내놓을 수 있습니다.
군중이 선언되면 화면 지시도 그에 맞춰 바뀝니다: 군중은 심도 안에 머물며, 화면 속 인물 목록은 여전히 이름 있는 캐릭터만 셉니다.
별도 비용이 없습니다. 이 기능들은 샷 리스트의 속성이며, 샷 리스트는 에피소드 분량의 100자당 1 크레딧 기준으로 대본 길이에 따라 과금됩니다. 첫 프로젝트에서 무료로 제공되는 15장을 초과하는 설정지는 장당 7 크레딧이 부과되며, 렌더링은 출력 영상 초당 10 크레딧부터 시작합니다. 샷 전반에 걸쳐 인물 얼굴을 일관되게 유지하는 방법은 캐릭터 일관성을, 요금 체계는 가격 페이지를 참고하세요.
언어
아래 모든 시리즈는 동일한 파이프라인으로 제작되었으며, 출연진이 해당 언어를 원어민 수준으로 구사합니다. 인터페이스, 작업 문서, 대사까지 모두 같은 언어로 제공되며 더빙은 전혀 사용되지 않습니다. 직접 열어서 들어보세요.
A Carta de LisboaPortuguês원어민 대사
윈터 프라미스한국어당신의 언어로
El Secreto de CostaEspañol원어민 대사
浪人の誓い日本語원어민 대사
Ikrar JakartaBahasa Indonesia원어민 대사
Зимняя коронаРусский원어민 대사
L’Héritier du DéfiléFrançais원어민 대사
Il Tavolo dell'OlivaItaliano원어민 대사
De Vuurtoren van de FjordNederlands원어민 대사
العهد الصحراويالعربية원어민 대사
Çantasındaki SözleşmeTürkçe원어민 대사
Die Istanbul-TäuschungDeutsch원어민 대사
Останній сигналУкраїнська원어민 대사
問劍青雲繁體中文원어민 대사
The Last EnvelopeEnglish원어민 대사이름 있는 인물 4명이 인물 정합성이 무너지기 시작하는 실질적인 상한이며, 숏 목록은 이를 넘지 않도록 구성합니다—군상 장면은 넓은 단체 프레임 대신 1인 숏과 숄더 숏으로 나눠 담습니다.
그것이 바로 숏별 화면 목록이 막으려는 오류입니다. 쳐다보거나 말을 건 대상일 뿐인 캐릭터는 이름이 아닌 연출 지시로 적고 화면 목록에 넣지 않습니다—그래서 설정화가 붙지 않고 엉뚱한 얼굴이 만들어지지 않습니다.
네, 측면 2인 숏이나 숄더 숏으로 가능합니다. 되지 않는 건 한 사람이 다른 사람을 마주 보고 다른 사람은 배경에 흐릿하게 두는 구성입니다: 그런 프레이밍과 심도 조합은 물리적으로 일관성이 없으며, 요청하면 카메라를 보고 말하는 사람 뒤에 다른 사람이 서 있는 모습이 나옵니다.
등장인물의 정체, 위치, 행동은 세그먼트 헤더에 한 번만 명시되며, 해당 장면 내내 일관되게 유지됩니다. 아무것도 명시하지 않으면 해당 샷에 군중은 등장하지 않습니다. 주변의 군중 소리만으로는 시각적 지시로 간주하지 않습니다.
각 대사의 지정된 화자만 입을 움직입니다. 프레임 안 다른 인물은 모두 입을 다문 상태로 명시 표시되어, 듣는 사람이 대사에 맞춰 조용히 입을 따라 움직이는 현상을 막습니다.
군중 장면을 하나 생성해서 얼굴 수를 세어 보세요.
SceneMixer 무료로 체험하기크레딧 패키지 $1.49부터 · Pro $7.99/월 · 시작 시 신용카드 불필요