SceneMixer
繁體中文
免費註冊

角色一致性

可維持角色一致性的 AI 影片生成器

更新於 September 20, 2026

簡單說:角色長相跑掉,是多數 AI 影片做不成系列的主因:到第 5 集主角的下顎線變了,觀眾就不會覺得這是同一部劇。SceneMixer 用四道機制解決這個問題——演員只生成一次做為設定圖、角色出現的每個片段都附上臉部與身體裁切圖、用識別碼而非名稱連結參考資料,以及明確規定不能在畫面外指名角色。刻意安排的造型變動會另外做設定圖,而不是只寫在提示詞裡。
AI 短劇《星隕指揮所》劇照,由 SceneMixer 端到端生成(7 位角色、1 集)
範例:《星隕指揮所》— 真人寫實高清畫質,1 集,由 SceneMixer 從劇本端到端產出 · 觀看集數

為什麼角色會跑掉

文生影片模型每次生成都是獨立作業。第 1 鏡描述一位三十多歲、眉毛有一道疤的女性,到第 30 鏡再描述一次,你會得到兩位各自符合描述、但長得不一樣的女性——形容詞沒辦法精準定義一張臉。下面所有修正方法核心概念都一樣:別再用文字描述角色,直接把角色的照片交給模型。

四道鎖

各機制的作用
設定圖每個角色只生成一次 9:16 比例的全身設定圖,採純背景、方向性主光——這是選角照,不是氛圍圖,因為設定圖裡的光線會被所有用到它的鏡頭繼承。
附加裁切圖從設定圖裁出的臉部與身體圖,會隨著角色出現的每個片段一起送進模型。模型是比對照片,而不是解讀文字描述。
用識別碼連結分鏡用識別碼指向素材,不是用名稱。就算兩個角色同名,或專案做到一半改名,也不會默默打亂一致性。
畫面外規則如果角色只是被注視、被對話、被伸手找——但本人不在畫面裡——就只寫成動作指示,絕不指名。點名不在場的角色,會讓模型把那個人的臉貼進單人鏡頭裡。

還有第五個比較小的機制:畫面裡每個人都會帶一兩個從自身描述取出的臉部辨識特徵,能減少兩個穿同款制服的角色在鏡頭中互換長相的常見失敗狀況。

當角色本來就該改變時

一致性不代表「永遠不變」——第 6 集被火燒到的角色,第 7 集看起來就得像燒傷。分界線取決於影片模型怎麼處理參考圖:它幾乎會原封不動地複製臉、衣服、外型與結構,再把光線、天氣、時段當成效果疊上去。

搞反這點兩邊都很燒錢:為「拿著杯子」做變體,等於花錢生成一張永遠不會出現在畫面裡的圖;用提示詞寫「火災過後」,模型會客氣地忽略,繼續用參考圖裡乾淨的房間。

目前還沒解決的問題

分層解釋、以及每一層能抓到和抓不到什麼,請看角色一致性說明。

費用

設定圖是獨立計費項目,和劇本分析分開(每3,333個英文字元4點數):每個帳號可免費獲得15張參考圖,之後額外生成或重新生成的圖,在預設圖片模型上每張7點數。狀態變體在第一個專案有少量免費額度,之後同樣以圖片計費。影片本身輸出每秒10點數起(在最低點數單價方案約$0.06/秒),不論有沒有附參考圖——一致性不收額外費用。詳情請看計價頁面。

免費用你自己的演員測試

在這個領域,一致性是你絕對不該只聽廠商說了算的宣稱,而你也不用盲信。新帳號內含50點數、15張可用在角色、場景、道具的免費參考圖、第一個專案免費一組第1集分鏡,以及一次最長5秒的免費預覽,會用你自己的設定圖算繪你那集的開場鏡頭。這就足夠做真實測試了:

  1. 貼入一段同樣兩個人間隔數分鐘多次出現的場景。
  2. 讓分析功能建立演員清單,在畫圖前先看過角色描述,把不對的地方改好——設定圖是從那段文字生成的。
  3. 生成設定圖。一張參考圖生成時間中位數約 16 秒,九成在 27 秒內完成,所以五個角色的演員群大概幾分鐘就好。
  4. 把免費預覽用在角色有在動作、不是站著不動的鏡頭,再把臉和設定圖對照。

給你一個參考基準:本平台上的專案中位數是五個有名有姓的角色,九成專案少於十個。如果你的故事需要三十個,機制還是一樣——成本在設定圖,不在一致性本身。

每一集都支援十五種語言

對白語言會在步驟 1 一次設定完成,整個產出流程都會使用該語言;目標地區設定也會同時把姓名、長相、街景調整成符合當地市場的樣子。下方每個範例都是用這個方式產出,每種語言各一份。

語言

15 種語言的母語對白

以下每一部影集都由同一條流程產製,演員以該語言母語演出:介面、工作文件與台詞全為同一語言,完全沒有配音。打開來聽聽看。

查看全部 15 種語言

常見問題

角色一致性實際上到底有多穩?

整個系列維持同一張臉是我們的設計目標,而參考圖架構就是為了讓你素材庫裡的演員陣容達成這件事。但這不是每一幀都百分之百保證:穿著完全相同的角色出現在同一個鏡頭裡,或是角色設定圖大部分都是外套的狀況,仍然是比較難處理的案例。除此之外——不論是集數、經過的時間、角色出現在多少個鏡頭——都不會讓一致性下降,因為每個鏡頭都是比對同一張圖片來生成。

我可以上傳自己的角色圖片,而不是用生成的嗎?

可以。任何設定圖都可以替換成你上傳的圖片,後續流程會把它當成生成的設定圖完全一樣處理。如果你已經在其他地方設計好角色,就用這個方式匯入。

可以用真人的臉嗎?

技術上來說,上傳功能不會管你上傳的是什麼圖片,但在大多數市場,發布使用真人長相的 AI 影片會有法律問題,我們的合規指南也將這類用途視為高風險。我們不提供換臉工具,也不建議這麼做。

如果我在專案進行到一半幫角色改名會怎麼樣?

不會壞掉。分鏡是用識別碼來參照素材,改名的同時會同步更新所有儲存的文字內容。在 2026 年 9 月之前,參照是用名稱比對的,而這次改版就是為了徹底解決當時會出現的比對失敗問題。

維持角色一致性,每個鏡頭需要額外付費嗎?

不用。在片段加上設定圖不會改變每秒的計費費率——每張設定圖你只需要付一次費用,之後不論多少個鏡頭用到它,都不會再額外收費。在這裡,一致性是架構內建的功能,不是用來加價銷售的項目。

我需要在每個鏡頭重新描述角色的長相嗎?

不用,而且你不應該這麼做。鏡頭文字只要寫出角色名稱就好,長相由設定圖負責。如果在鏡頭文字裡重複描述外觀,會把模型拉回文字描述、偏離參考圖,這正是這個設計要避免的長相漂移問題。

同一集裡同一個角色可以有兩種造型嗎?

可以——這就是狀態變體的用途。每種造型都是獨立的參考圖,分鏡可以針對個別片段指定要套用哪一張,精細到單一片段等級,不用整集都用同一張。

第 1 集和第 40 集都是同一張臉

演員陣容只要生成一次,之後每個鏡頭都是比對圖片,不是比對文字描述。

免費試用 SceneMixer

點數套餐自 $1.49 起 · Pro $7.99/月 · 開始使用不需要信用卡

價格方案·使用指南·作品範例·支援服務·隱私權政策·服務條款·法律資訊·聯絡我們·© 2026 SceneMixer