服裝一致性
更新於 September 20, 2026

大家很自然會想在每個鏡頭裡都描述衣服,但這是錯的,而且代價很高:鏡頭提示裡塞一整段服裝描述,會和臉部搶模型的注意力;在直式畫面裡,這會把鏡頭拉得非常遠,頭縮到太小,角色根本認不出來。一件淺色大衣占滿畫面七成、上面頂著一張小臉,這不是假設,是真實會發生的失敗狀況。
所以服裝要放在角色的設定圖上,鏡頭只要引用角色,不要重複描述服裝。設定圖定義好的內容,每個鏡頭都會自動繼承。
| 角色設定圖 | 一套服裝,用因果性的詞彙描述——剪裁、面料、結構、開合方式——並渲染成白底的選角照風格。 |
|---|---|
| 服裝風格軸 | 專案層級的風格登錄(時代、剪裁傳統、面料與工藝),在分析階段一次性注入,讓全體角色都穿在同一個世界觀裡。 |
| 第二套服裝 | 要做成獨立的參考圖——是角色的一個狀態,不是某個鏡頭裡的一句描述。 |
| 細微變化 | 下雨、灰塵、領口鬆開、手上拿東西:寫在鏡頭的文字裡即可,不需要第二張圖。 |
| 鏡頭提示 | 引用角色即可。不要重列服裝,也不要把鏡頭拉遠來展示衣服。 |
要不要做第二張圖,關鍵就在這條線,而這來自參考圖條件式影片模型的行為:它們會幾乎原封不動地複製圖裡的東西——臉、服裝、配件、結構;至於覆蓋在畫面上的全域效果——天氣、時段、光線、髒汙——則接受用文字描述。
最常見的錯誤,就是把這條線畫錯、做了太多圖:早期系統自動偵測到的「狀態」,很多其實是拿杯子、燈點亮之類的東西。這些都應該用文字。現在流程會刻意限制每個角色最多提出幾個狀態,正是因為過度生成狀態只會燒錢,沒有任何好處。
劇本常會把角色的服裝寫成一條弧線——前幾集穿一套、後面換一套,再加一套婚紗。如果把這三套一次丟進同一段描述,渲染出來的人物會每套各穿一半。所以在生成任何圖片之前,就要先把描述結構性拆開:第一套服裝留在基礎設定圖上,其他的做成獨立的狀態圖。部位標籤(鞋款、配件、面料)會被辨識為同一套服裝的一部分,而不是第二套。
每個鏡頭的優先順序如下:為該片段指定的狀態 → 單集覆蓋圖 → 為該集指派的狀態 → 基礎設定圖。只有實際渲染完成的狀態才算數——如果某個狀態只寫在紙上、沒有對應圖片,鏡頭就會退回基礎設定圖,並把差異用文字補上,所以就算沒有圖,變化還是會被描述出來。
指派是自動的:鏡頭清單生成後,會跑一次流程決定每個片段要用哪個狀態並記錄下來。刻意以片段而非集為單位來做,是因為如果把回憶造型套用到一整集,會讓該集裡每個鏡頭的角色都穿錯衣服。
每張狀態圖都是一張生成圖:7 credits。你的第一個專案會包含15張免費參考圖,適用於角色、場景與道具;而在第一個專案裡,狀態圖另有獨立的免費額度——所以試做一套完全不用花錢。純文字的變化完全免費,這也是為什麼值得學會「狀態 vs 描述句」這條線。基礎圖的建立方式請看角色設定圖,費率請看價格頁。
語言
以下每一部影集都由同一條流程產製,演員以該語言母語演出:介面、工作文件與台詞全為同一語言,完全沒有配音。打開來聽聽看。
A Carta de LisboaPortuguês母語對白
윈터 프라미스한국어母語對白
El Secreto de CostaEspañol母語對白
浪人の誓い日本語母語對白
Ikrar JakartaBahasa Indonesia母語對白
Зимняя коронаРусский母語對白
L’Héritier du DéfiléFrançais母語對白
Il Tavolo dell'OlivaItaliano母語對白
De Vuurtoren van de FjordNederlands母語對白
العهد الصحراويالعربية母語對白
Çantasındaki SözleşmeTürkçe母語對白
Die Istanbul-TäuschungDeutsch母語對白
Останній сигналУкраїнська母語對白
問劍青雲繁體中文你的語言
The Last EnvelopeEnglish母語對白因為重複描述會和臉部搶注意力,把鏡頭往後拉來展示衣服,導致頭部縮小、角色認不出來。服裝只要在設定圖上定義一次,之後所有提到該角色的鏡頭都會自動沿用。
當服裝本身完全改變——整套換裝、盔甲、制服,或是燒毀、破損到認不出來的狀況。如果只是同一件衣服濕了、髒了、沾了血,或是釦子沒扣,直接寫在鏡頭描述裡就好;參考圖條件式模型會把這些當成疊在畫面上的效果處理。
系統會在生成任何畫面之前先拆分描述:第一套服裝會留在基礎設定圖上,後續的服裝則會各自成為獨立的狀態圖。如果一次把全部狀態都丟給模型,單次渲染會畫出同時穿著好幾套服裝零件的人物。
針對該片段選定的狀態優先,接著是單集覆寫設定,再來是指派給該集的狀態,最後才是基礎設定表。沒有渲染圖片的狀態不會計入——這時鏡頭會使用基礎設定表,並以文字說明差異。
不行。服裝在鏡頭生成時就已經固定,所以要改變服裝就必須重新生成該片段,並依照一般每秒費率計價。