角色一致性
更新於 September 20, 2026

文生影片模型每次生成都是獨立作業。第 1 鏡描述一位三十多歲、眉毛有一道疤的女性,到第 30 鏡再描述一次,你會得到兩位各自符合描述、但長得不一樣的女性——形容詞沒辦法精準定義一張臉。下面所有修正方法核心概念都一樣:別再用文字描述角色,直接把角色的照片交給模型。
| 設定圖 | 每個角色只生成一次 9:16 比例的全身設定圖,採純背景、方向性主光——這是選角照,不是氛圍圖,因為設定圖裡的光線會被所有用到它的鏡頭繼承。 |
|---|---|
| 附加裁切圖 | 從設定圖裁出的臉部與身體圖,會隨著角色出現的每個片段一起送進模型。模型是比對照片,而不是解讀文字描述。 |
| 用識別碼連結 | 分鏡用識別碼指向素材,不是用名稱。就算兩個角色同名,或專案做到一半改名,也不會默默打亂一致性。 |
| 畫面外規則 | 如果角色只是被注視、被對話、被伸手找——但本人不在畫面裡——就只寫成動作指示,絕不指名。點名不在場的角色,會讓模型把那個人的臉貼進單人鏡頭裡。 |
還有第五個比較小的機制:畫面裡每個人都會帶一兩個從自身描述取出的臉部辨識特徵,能減少兩個穿同款制服的角色在鏡頭中互換長相的常見失敗狀況。
一致性不代表「永遠不變」——第 6 集被火燒到的角色,第 7 集看起來就得像燒傷。分界線取決於影片模型怎麼處理參考圖:它幾乎會原封不動地複製臉、衣服、外型與結構,再把光線、天氣、時段當成效果疊上去。
搞反這點兩邊都很燒錢:為「拿著杯子」做變體,等於花錢生成一張永遠不會出現在畫面裡的圖;用提示詞寫「火災過後」,模型會客氣地忽略,繼續用參考圖裡乾淨的房間。
分層解釋、以及每一層能抓到和抓不到什麼,請看角色一致性說明。
設定圖是獨立計費項目,和劇本分析分開(每3,333個英文字元4點數):每個帳號可免費獲得15張參考圖,之後額外生成或重新生成的圖,在預設圖片模型上每張7點數。狀態變體在第一個專案有少量免費額度,之後同樣以圖片計費。影片本身輸出每秒10點數起(在最低點數單價方案約$0.06/秒),不論有沒有附參考圖——一致性不收額外費用。詳情請看計價頁面。
在這個領域,一致性是你絕對不該只聽廠商說了算的宣稱,而你也不用盲信。新帳號內含50點數、15張可用在角色、場景、道具的免費參考圖、第一個專案免費一組第1集分鏡,以及一次最長5秒的免費預覽,會用你自己的設定圖算繪你那集的開場鏡頭。這就足夠做真實測試了:
給你一個參考基準:本平台上的專案中位數是五個有名有姓的角色,九成專案少於十個。如果你的故事需要三十個,機制還是一樣——成本在設定圖,不在一致性本身。
對白語言會在步驟 1 一次設定完成,整個產出流程都會使用該語言;目標地區設定也會同時把姓名、長相、街景調整成符合當地市場的樣子。下方每個範例都是用這個方式產出,每種語言各一份。
語言
以下每一部影集都由同一條流程產製,演員以該語言母語演出:介面、工作文件與台詞全為同一語言,完全沒有配音。打開來聽聽看。
A Carta de LisboaPortuguês母語對白
윈터 프라미스한국어母語對白
El Secreto de CostaEspañol母語對白
浪人の誓い日本語母語對白
Ikrar JakartaBahasa Indonesia母語對白
Зимняя коронаРусский母語對白
L’Héritier du DéfiléFrançais母語對白
Il Tavolo dell'OlivaItaliano母語對白
De Vuurtoren van de FjordNederlands母語對白
العهد الصحراويالعربية母語對白
Çantasındaki SözleşmeTürkçe母語對白
Die Istanbul-TäuschungDeutsch母語對白
Останній сигналУкраїнська母語對白
問劍青雲繁體中文你的語言
The Last EnvelopeEnglish母語對白整個系列維持同一張臉是我們的設計目標,而參考圖架構就是為了讓你素材庫裡的演員陣容達成這件事。但這不是每一幀都百分之百保證:穿著完全相同的角色出現在同一個鏡頭裡,或是角色設定圖大部分都是外套的狀況,仍然是比較難處理的案例。除此之外——不論是集數、經過的時間、角色出現在多少個鏡頭——都不會讓一致性下降,因為每個鏡頭都是比對同一張圖片來生成。
可以。任何設定圖都可以替換成你上傳的圖片,後續流程會把它當成生成的設定圖完全一樣處理。如果你已經在其他地方設計好角色,就用這個方式匯入。
技術上來說,上傳功能不會管你上傳的是什麼圖片,但在大多數市場,發布使用真人長相的 AI 影片會有法律問題,我們的合規指南也將這類用途視為高風險。我們不提供換臉工具,也不建議這麼做。
不會壞掉。分鏡是用識別碼來參照素材,改名的同時會同步更新所有儲存的文字內容。在 2026 年 9 月之前,參照是用名稱比對的,而這次改版就是為了徹底解決當時會出現的比對失敗問題。
不用。在片段加上設定圖不會改變每秒的計費費率——每張設定圖你只需要付一次費用,之後不論多少個鏡頭用到它,都不會再額外收費。在這裡,一致性是架構內建的功能,不是用來加價銷售的項目。
不用,而且你不應該這麼做。鏡頭文字只要寫出角色名稱就好,長相由設定圖負責。如果在鏡頭文字裡重複描述外觀,會把模型拉回文字描述、偏離參考圖,這正是這個設計要避免的長相漂移問題。
可以——這就是狀態變體的用途。每種造型都是獨立的參考圖,分鏡可以針對個別片段指定要套用哪一張,精細到單一片段等級,不用整集都用同一張。
演員陣容只要生成一次,之後每個鏡頭都是比對圖片,不是比對文字描述。
免費試用 SceneMixer點數套餐自 $1.49 起 · Pro $7.99/月 · 開始使用不需要信用卡