일관된 캐릭터
2026년 9월 20일 업데이트

텍스트 투비디오 모델은 생성을 각각 독립적으로 렌더링합니다. 1번 컷에서 눈썹에 흉터가 있는 30대 여성을 묘사하고 30번 컷에서 다시 똑같이 묘사해도, 설명에는 맞지만 서로 닮지 않은 두 여성이 나옵니다 — 형용사만으로는 얼굴을 충분히 특정하지 못하기 때문이죠. 아래의 모든 해결책은 본질적으로 같습니다: 캐릭터를 설명하는 대신, 모델에 그 사람 사진을 건네주는 것입니다.
| 레퍼런스 시트 | 각 캐릭터는 단색 배경에 방향성 키라이트를 적용한 9:16 비율의 전신 시트로 한 번만 생성됩니다 — 분위기용 이미지가 아니라 캐스팅 사진인 이유는, 시트에 담긴 조명이 그 시트를 쓰는 모든 컷에 그대로 상속되기 때문입니다. |
|---|---|
| 첨부 크롭 | 해당 시트에서 자른 얼굴과 신체 크롭이 캐릭터가 등장하는 모든 세그먼트에 함께 전송됩니다. 모델이 설명을 해석하는 대신 사진을 보고 맞춥니다. |
| ID 기반 연결 | 스토리보드는 에셋을 이름이 아닌 식별자로 가리킵니다. 같은 이름의 캐릭터가 둘 있거나 프로젝트 중간에 이름을 바꿔도 연결이 조용히 끊기지 않습니다. |
| 오프스크린 규칙 | 누군가 쳐다보거나 말을 걸거나 손을 뻗는 대상이지만 화면에는 없는 캐릭터는 이름을 쓰지 않고 연출로 적습니다. 없는 캐릭터를 이름으로 부르면 모델이 1인 컷에 그 사람 얼굴을 덧붙여 버립니다. |
다섯 번째, 작은 장치 하나: 한 컷에 등장하는 각 인물에게는 본인 설명에서 뽑은 한두 가지 두드러진 얼굴 특징을 넣어, 같은 제복을 입은 두 캐릭터가 컷 중간에 얼굴이 바뀌는 고전적인 실패를 줄여줍니다.
일관성이 "절대 바뀌지 않음"을 의미할 수는 없습니다 — 6화에서 불에 탄 캐릭터는 7화에서 화상 입은 모습이어야 하니까요. 구분선은 비디오 모델이 레퍼런스 이미지를 어떻게 다루는가에 있습니다: 모델은 얼굴, 의상, 형태와 구조를 거의 그대로 복사하고, 조명, 날씨, 시간대는 그 위에 겹쳐진 효과로 적용합니다.
이걸 거꾸로 하면 양쪽 모두 비용이 낭비됩니다: "컵을 들고 있음"용 변형본은 비용을 지불해도 화면에 나오지 않는 이미지가 되고, "화재 이후"를 프롬프트로 적으면 모델은 레퍼런스의 깨끗한 방을 우선해서 요청을 정중히 무시합니다.
각 계층이 무엇을 잡아내고 무엇을 놓치는지에 대한 계층별 설명은 캐릭터 일관성 가이드에 있습니다.
레퍼런스 시트는 대본 분석과 별개의 항목입니다(영어 텍스트 3,333자당 4 크레딧): 계정마다 레퍼런스 이미지 15장이 무료로 제공되고, 그 이후 추가 생성이나 재생성은 기본 이미지 모델 기준 장당 7 크레딧입니다. 상태 변형본은 첫 프로젝트에서 소량의 무료 할당이 제공되며 이후에는 이미지로 과금됩니다. 동영상 자체는 레퍼런스 첨부 여부와 관계없이 출력 초당 10 크레딧부터 시작합니다(최저 크레딧 단가 기준 약 $0.06/초). 일관성에 추가 요금은 없습니다. 자세한 내용은 가격 페이지를 참고하세요.
이 분야에서 일관성은 절대 믿고 받아들이면 안 되는 주장이며, 그럴 필요도 없습니다. 신규 계정에는 50 크레딧, 캐릭터·장면·소품 전반에 걸쳐 15장의 무료 레퍼런스 이미지, 첫 프로젝트의 무료 1화 스토리보드, 그리고 본인의 시트로 본인 에피소드의 오프닝 컷을 렌더링하는 최대 5초 분량의 무료 프리뷰 1회가 제공됩니다. 이는 실제 테스트에 충분합니다:
참고로: 이 플랫폼의 중간값 프로젝트는 이름 있는 캐릭터가 5명이고, 10개 중 9개는 10명 미만입니다. 스토리에 30명이 필요해도 같은 방식이 그대로 적용됩니다 — 비용이 드는 것은 시트이지 일관성 자체가 아닙니다.
대사 언어는 1단계에서 한 번만 설정하면 전체 생성 과정에 적용되며, 타겟 지역 설정에 맞춰 인물 이름, 얼굴, 거리 풍경까지 해당 시장에 맞춰 자동 조정됩니다. 아래 각 샘플은 이 방식으로 언어별로 하나씩 제작되었습니다.
언어
아래 모든 시리즈는 동일한 파이프라인으로 제작되었으며, 출연진이 해당 언어를 원어민 수준으로 구사합니다. 인터페이스, 작업 문서, 대사까지 모두 같은 언어로 제공되며 더빙은 전혀 사용되지 않습니다. 직접 열어서 들어보세요.
A Carta de LisboaPortuguês원어민 대사
윈터 프라미스한국어당신의 언어로
El Secreto de CostaEspañol원어민 대사
浪人の誓い日本語원어민 대사
Ikrar JakartaBahasa Indonesia원어민 대사
Зимняя коронаРусский원어민 대사
L’Héritier du DéfiléFrançais원어민 대사
Il Tavolo dell'OlivaItaliano원어민 대사
De Vuurtoren van de FjordNederlands원어민 대사
العهد الصحراويالعربية원어민 대사
Çantasındaki SözleşmeTürkçe원어민 대사
Die Istanbul-TäuschungDeutsch원어민 대사
Останній сигналУкраїнська원어민 대사
問劍青雲繁體中文원어민 대사
The Last EnvelopeEnglish원어민 대사시리즈 전체에 걸쳐 동일한 얼굴을 유지하는 것이 설계 목표이며, 에셋 라이브러리의 배우 정보에 대해 참조 시트 아키텍처가 이를 구현합니다. 모든 프레임을 100% 보장하는 것은 아닙니다: 똑같은 옷을 입은 인물이 한 컷에 함께 등장하거나, 시트 내용이 대부분 코트인 인물은 여전히 까다로운 케이스입니다. 그 외 에피소드 수, 경과 시간, 인물 등장 컷 수 등은 일관성을 저하시키지 않는데, 모든 컷이 동일한 이미지를 기준으로 매칭되기 때문입니다.
네. 어떤 참조 시트든 업로드한 이미지로 교체할 수 있으며, 파이프라인의 나머지 과정은 생성된 이미지와 똑같이 취급합니다. 다른 곳에서 이미 디자인한 캐릭터를 사용할 때 이 방법을 쓰시면 됩니다.
기술적으로 업로드 기능은 이미지가 무엇인지 가리지 않지만, 실제 인물의 초상을 사용한 AI 영상을 게시하는 것은 대부분의 지역에서 법적 문제가 되며, 당사 컴플라이언스 가이드에서도 이를 문제로 다룹니다. 페이스 스왑 툴을 제공하지 않으며, 사용을 권장하지도 않습니다.
아무 문제 없습니다. 스토리보드는 식별자로 에셋을 참조하며, 이름 변경은 저장된 텍스트 전체에 동시에 반영됩니다. 2026년 9월 이전에는 이름으로 참조를 매칭했는데, 이번 변경으로 바로 그 오류가 해소되었습니다.
아니요. 세그먼트에 참조 설정화를 첨부해도 초당 요금은 바뀌지 않습니다 — 각 참조 시트에 대해 한 번만 결제하면, 몇 개의 컷에서 사용하든 추가 비용이 없습니다. 일관성은 여기서 아키텍처로 구현된 기능이지, 추가 판매 상품이 아닙니다.
아니요, 그럴 필요도 없습니다. 컷 텍스트에는 캐릭터 이름만 적으면 되고, 참조 설정화에 외형 정보가 담겨 있습니다. 컷 텍스트에 외형 설명을 반복해서 적으면 모델이 이미지 대신 텍스트에 의존하게 되어 외형이 달라지는 드리프트가 발생하는데, 이 설계는 바로 그 문제를 없앱니다.
네 — 상태 베리언트가 바로 그 용도입니다. 각 모습은 별도의 참조 이미지로 저장되며, 스토리보드에서 세그먼트 단위로 어떤 모습을 적용할지 지정합니다. 에피소드 전체가 아니라 개별 세그먼트마다 지정할 수 있습니다.
캐스트를 한 번 생성하면, 그 뒤 모든 컷은 설명이 아니라 이미지를 기준으로 매칭됩니다.
SceneMixer 무료로 체험하기크레딧 패키지 $1.49부터 · Pro $7.99/월 · 시작할 때 신용카드 필요 없음