SceneMixer
한국어
무료 가입

AI 다인물 장면

AI 다인물 장면 생성기

2026년 9월 20일 업데이트

간단한 답변: 모든 숏에는 화면에 등장하는 인물의 명시적인 목록이 붙으며, 이 목록만이 캐릭터 설정화를 연결하는 유일한 기준입니다. 그래서 그저 쳐다보거나 말을 건 상대는 이름이 아닌 연출 지시로 처리되어, 엉뚱한 얼굴을 달고 화면에 나타나지 않습니다. 대사를 말하는 지정된 인물의 입만 움직입니다. 배경 군중은 장면에 명시적으로 선언된 상태일 때만 존재하고, 그렇지 않으면 넣지 않습니다. 한 화면에 이름이 지정된 인물이 4명을 넘어가면, 장면 전체를 1인 숏들로 나눠 구성합니다.
SceneMixer가 엔드투엔드 생성한 AI 숏드라마 “러스트 시티 녹아웃”의 스틸컷 (캐릭터 6명, 에피소드 1개)
샘플: “러스트 시티 녹아웃” — 유화풍 애니메이션, 에피소드 1개, 대본부터 SceneMixer 파이프라인으로 엔드투엔드 제작 · 에피소드 보기

문제는 '몇 명'이 아니라 '누가 화면에 있느냐'다

생성형 영상은 한 숏에 두 명 이상이 나올 때 특정한 오류를 냅니다. 바로 없어야 할 얼굴을 집어넣는 것입니다. 텍스트에서 언급된 사람—쳐다본 대상, 소리친 상대, 떠올린 인물—이 그 자리에서 만들어낸 얼굴을 달고 화면에 나타나는데, 모델이 '현재 화면에 있음'과 '언급됨'의 차이를 전달받지 못했기 때문입니다.

그래서 숏 목록은 숏마다 이를 명시합니다. 각 숏에는 화면에 어떤 캐릭터가 있는지 적힌 명시적 목록이 붙으며, 이 목록이—산문도, 이전 숏의 마지막 상태도 아닌—누구의 설정화를 연결할지 유일하게 결정합니다.

한눈에 보기

다인물 숏 지정 방식
화면 속 인물숏별 목록입니다. 한 세그먼트 내 모든 숏의 목록을 합쳐서 해당 세그먼트에 함께 보낼 설정화를 정합니다.
화면 밖 인물이름이 아닌 연출 지시—'화면 왼쪽을 향해', '카메라로 시선 맞춤'—로 적습니다. 얼굴은 연결되지 않습니다.
1인 숏명시적으로 표시해서, 렌더러가 화면에 한 사람만 있다고 인식하고 동행 인물을 만들어내지 않도록 합니다.
말하는 사람대사 줄마다 이름을 지정합니다. 화면 속 다른 모든 인물은 입을 다문 상태로 표시해, 말하는 사람의 입만 움직이도록 합니다.
배경 군중세그먼트 헤더에 한 번 적어 장면의 상태로 선언하거나, 아예 넣지 않습니다. 환경음으로 암시하지 않습니다.
실질적인 상한한 화면에 이름 있는 인물 4명을 넘어가면 품질이 떨어지기 시작합니다. 숏 목록은 이를 뚫고 가는 대신 우회해서 구성합니다.

화면 밖 인물에 이름을 붙이면 숏이 망가지는 이유

이것은 이론이 아니라 측정 가능한 결과입니다. 화면 밖 적대자에게 이름을 붙인 숏은 8번 렌더링 중 5번에서 잘못된 얼굴이나 엉뚱한 사람이 추가로 나왔습니다. 같은 숏에서 이름 대신 방향 지시로 고쳐 쓴 버전은 12번 렌더링에서 해당 오류가 0건이었습니다. 그래서 파이프라인은 이를 재작성합니다: 1인 숏에서 시선 방향이나 이동 방향으로만 존재하는 인물은 공간적 표현으로 바꾸고 화면 목록에서 제거합니다.

같은 논리가 죽은 인물에도 적용됩니다: 이 세그먼트에서 시체로만 언급되는 캐릭터는 캐릭터 참조가 아닌 평범한 명사로 적어서, 아무도 설정화를 붙여 그 사람을 일어서게 하지 않도록 합니다.

마주 보는 두 사람

이를 찍는 방식은 정확히 두 가지뿐이며, 목록에서 둘 중 하나를 골라야 합니다: 측면 2인 숏, 혹은 숄더 숏. 여기서 쓸 수 없는 표현은 “A가 B를 마주 보고, B는 배경에서 초점이 흐릿하게 뒤에 있다”는 것입니다—B가 A의 심도 밖에 있으려면 A가 B에게 등을 보여야 하는데, 일반적인 미디엄 숏에는 그런 카메라 위치가 존재하지 않습니다. 억지로 요청하면 렌더러는 한 사람은 카메라를 정면으로 보고 다른 한 사람은 그 뒤에 서 있는 모습을 내놓습니다. 두 사람이 실제로 함께 화면에 나오는 첫 번째 숏에서 축이 정해집니다.

군중은 선언하거나 넣지 않는다

손님 300명이 있는 방은 장면의 눈에 보이는 상태이므로 그렇게 적습니다—세그먼트 헤더에 배경 인물이 누구이고 어디에 있으며 무엇을 하는지 적는 한 줄을 넣습니다. 해당 장면의 모든 세그먼트에 일관되게 적용됩니다. 그 줄이 없으면 숏에서 군중을 전혀 언급할 수 없습니다. 환경음에 “손님들의 웅성거림”이 있다는 건 시각적 지시가 아니기 때문에, 그것만 알려준 렌더러는 한 숏에는 손님을 넣고 다음 숏에는 텅 빈 홀을 내놓을 수 있습니다.

군중이 선언되면 화면 지시도 그에 맞춰 바뀝니다: 군중은 심도 안에 머물며, 화면 속 인물 목록은 여전히 이름 있는 캐릭터만 셉니다.

하지 않는 것

비용

별도 비용이 없습니다. 이 기능들은 샷 리스트의 속성이며, 샷 리스트는 에피소드 분량의 100자당 1 크레딧 기준으로 대본 길이에 따라 과금됩니다. 첫 프로젝트에서 무료로 제공되는 15장을 초과하는 설정지는 장당 7 크레딧이 부과되며, 렌더링은 출력 영상 초당 10 크레딧부터 시작합니다. 샷 전반에 걸쳐 인물 얼굴을 일관되게 유지하는 방법은 캐릭터 일관성을, 요금 체계는 가격 페이지를 참고하세요.

언어

15개 언어 원어민 대사

아래 모든 시리즈는 동일한 파이프라인으로 제작되었으며, 출연진이 해당 언어를 원어민 수준으로 구사합니다. 인터페이스, 작업 문서, 대사까지 모두 같은 언어로 제공되며 더빙은 전혀 사용되지 않습니다. 직접 열어서 들어보세요.

15개 언어 모두 보기

자주 묻는 질문

한 숏에 캐릭터를 몇 명까지 넣을 수 있나요?

이름 있는 인물 4명이 인물 정합성이 무너지기 시작하는 실질적인 상한이며, 숏 목록은 이를 넘지 않도록 구성합니다—군상 장면은 넓은 단체 프레임 대신 1인 숏과 숄더 숏으로 나눠 담습니다.

언급만 한 캐릭터가 왜 화면에 나왔나요?

그것이 바로 숏별 화면 목록이 막으려는 오류입니다. 쳐다보거나 말을 건 대상일 뿐인 캐릭터는 이름이 아닌 연출 지시로 적고 화면 목록에 넣지 않습니다—그래서 설정화가 붙지 않고 엉뚱한 얼굴이 만들어지지 않습니다.

두 캐릭터가 서로 마주 보고 대화할 수 있나요?

네, 측면 2인 숏이나 숄더 숏으로 가능합니다. 되지 않는 건 한 사람이 다른 사람을 마주 보고 다른 사람은 배경에 흐릿하게 두는 구성입니다: 그런 프레이밍과 심도 조합은 물리적으로 일관성이 없으며, 요청하면 카메라를 보고 말하는 사람 뒤에 다른 사람이 서 있는 모습이 나옵니다.

배경 엑스트라는 어떻게 작동하나요?

등장인물의 정체, 위치, 행동은 세그먼트 헤더에 한 번만 명시되며, 해당 장면 내내 일관되게 유지됩니다. 아무것도 명시하지 않으면 해당 샷에 군중은 등장하지 않습니다. 주변의 군중 소리만으로는 시각적 지시로 간주하지 않습니다.

누가 입을 움직이나요?

각 대사의 지정된 화자만 입을 움직입니다. 프레임 안 다른 인물은 모두 입을 다문 상태로 명시 표시되어, 듣는 사람이 대사에 맞춰 조용히 입을 따라 움직이는 현상을 막습니다.

프레임에 캐스팅하지 않은 인물은 아무도 등장하지 않습니다

군중 장면을 하나 생성해서 얼굴 수를 세어 보세요.

SceneMixer 무료로 체험하기

크레딧 패키지 $1.49부터 · Pro $7.99/월 · 시작 시 신용카드 불필요

요금·가이드·샘플·지원·개인정보 처리방침·이용약관·법적 고지·문의하기·© 2026 SceneMixer