會說話的角色
更新於 September 20, 2026

要讓角色在畫面裡開口說話,有兩種做法。一種是先算繪無聲影片,再用音軌去驅動嘴巴——也就是對嘴流程,這需要裁切人臉、準備驅動音檔,做出來的結果是嘴巴動得對,但身體沒有表演。另一種是畫面和聲音一起生成,表演和嘴型是同一個決定。
這套流程用的是第二種。預設的影片方案是影音同步生成:模型會拿到台詞、說話者、說話方式,以及語音參考,然後回傳一段已經把台詞說進去的鏡頭,後續不需要再縫合任何東西。
| 台詞 | 一字不差,只放一次。完全照寫的內容說出來——不會改寫,也不會重新調整節奏。 |
|---|---|
| 誰說的 | 要寫明角色,並綁定該角色的語音參考,讓同一個角色在不同集數裡聽起來聲音都一樣。 |
| 怎麼說 | 用括號寫簡短指示——壓低聲音、仍帶著笑意、硬擠出平淡語氣。這是表演指示,不是字幕。 |
| 畫面裡還有誰 | 會標註嘴唇閉合,讓聽的人不會跟著動嘴。 |
| 畫面外的台詞 | 會先在括號裡標註——旁白、講電話、透過對講機——接著描述畫面上所有可見人物的嘴巴都是閉上的。 |
| 時長 | 帶對話的鏡頭絕對不會短於台詞需要的長度:英文每秒三個字,中文每秒五個字。 |
每個角色都會從預建的系統語音庫裡分配一個聲音——你可以先聽三到八秒的試聽再選,也可以重新配對、從選單換一個,或是上傳自己的錄音。之所以用配對而不是為每個角色客製聲音,是為了成本和穩定性:客製聲音在不同次生成之間容易飄移,而且每個角色都要額外花費;資料庫語音則從第一集到第十二集都是同一個聲音。
如果角色還沒分配語音,鏡頭會退回去用文字描述聲音——年齡、質地、音域——交給模型解讀。這是新專案的預設行為;分配語音是你主動做的步驟,不會默默套用到每個角色身上。
四秒的鏡頭塞不下十六個英文單字。不是講得太快到聽不清楚,就是台詞被切掉。所以對話鏡頭會依台詞設最低時長:英文用單字數除以三,中文用字數除以五;短句還會額外加一點停頓,而不是壓到理論上的最短長度。如果鏡頭回來時短到塞不下台詞,會在算繪前就被標出並修正——這比等成品出來才發現問題便宜得多。
對話語言是專案設定,選一次就好,而且會在台詞最初撰寫時就套用,不是事後再翻譯——所以表演一開始就是用那個語言演出,不是配音。介面支援十五種語言,對話也都能在這些語言下運作;在預設影片方案上,有少數語言偶爾會把個別字念錯,選單上遇到這種情況會直接標示。角色語音頁有更詳細的說明。
語音已經包含在影片價格裡——沒有額外的音訊費用。影片價格從每秒輸出 10 credits 起(在 最低點數單價 方案大約是 $0.06/秒),到最清晰的方案則是 $0.47/秒;組裝費用是每秒 1 credit。從語音庫配對語音完全免費。新帳號會拿到 50 credits,以及一次最長 5 秒的免費預覽——足夠讓你在決定之前先聽角色開口說話。費率可看 定價頁。
語言
以下每一部影集都由同一條流程產製,演員以該語言母語演出:介面、工作文件與台詞全為同一語言,完全沒有配音。打開來聽聽看。
A Carta de LisboaPortuguês母語對白
윈터 프라미스한국어母語對白
El Secreto de CostaEspañol母語對白
浪人の誓い日本語母語對白
Ikrar JakartaBahasa Indonesia母語對白
Зимняя коронаРусский母語對白
L’Héritier du DéfiléFrançais母語對白
Il Tavolo dell'OlivaItaliano母語對白
De Vuurtoren van de FjordNederlands母語對白
العهد الصحراويالعربية母語對白
Çantasındaki SözleşmeTürkçe母語對白
Die Istanbul-TäuschungDeutsch母語對白
Останній сигналУкраїнська母語對白
問劍青雲繁體中文你的語言
The Last EnvelopeEnglish母語對白不是。畫面和台詞是一次同時生成的,所以嘴型和表演是同一個決定。沒有另外的音軌去對無聲畫面,也不能用來驅動照片或你上傳的影片。
你可以上傳一段錄音做為角色的語音參考。但不提供複製他人聲音的功能。
不應該——畫面裡每個沒有在說話的角色,都會被明確標註嘴唇閉合,這個指示就是用來防止聽的人跟著台詞動嘴。
畫面外的標記會寫在表演註記的最前面,接著描述鏡頭裡所有可見人物的嘴巴都是閉上的——所以你會聽到台詞,但畫面上看起來沒有人在說那句話。
因為台詞需要那麼多時間。帶對話的鏡頭有最低時長,大約是英文每秒三個字、中文每秒五個字,很短的句子還會加上停頓。塞不下台詞的鏡頭會在算繪前就修正,而不是算完才改。