
在步驟 2 開啟角色,音色描述 欄位會在對話框底部、外觀描述的下方。口音就是寫在這個欄位裡。
聲音完全不是事後錄製、配音或拼接起來的。生成片段時,影片模型會在同一個程序中產生畫面並說出台詞,每個說話角色的描述都會做為該聲音的需求提示交給模型。這就是為什麼嘴型會和台詞吻合:聲音是生成的一部分,而非後加上去的圖層。對白與聲音在同一次生成中完成。
描述口音的文字不會被過濾、縮短或刪除:「聲音溫柔帶氣音、輕微的台灣國語、語速從容」會跟著這個角色在每個片段的每一句台詞——系統也不會質疑你是不是認真的。想要香港腔國語,就直接寫香港腔國語。
音色庫唯一做不到的就是口音。音色庫是依語言分類——中文、英文、廣東話——再依性別、年齡層和語氣來挑選匹配。沒有台灣腔選項、沒有蘇格蘭腔選項、沒有布魯克林腔選項,你描述裡的口音用字也不會影響音色的挑選。口音來自描述;音色庫的功用是維持聲音穩定。角色音色的運作方式。
有兩個地方可以看出角色處於哪種模式。在步驟 2 的角色卡片上,如果附加了音頻音色,名字旁邊會有一個小喇叭圖示——沒有圖示就代表由描述主控。在故事板編輯器中,@ 選單的 音色 分頁會列出所有角色:每個角色都有說話圖示,沒有音頻的角色旁邊還會有一個小小的 僅描述 標籤。將滑鼠停在圖示上會顯示是哪一種狀態——已指派音色,或是 僅音色描述(無音頻)。沒有標籤的圖示代表綠燈通行;有喇叭則代表附加了音頻樣本,包含口音在內的描述都不會被執行。
如果你發現狀態不對,開啟角色並使用 刪除音色——確認提示會說遠端檔案會保留,所以不會刪除任何東西,之後你還是可以再選取音色。這是免費的,而且會在你下次生成的片段生效。接著你的口音描述就會重新作用。
說明是哪種口音,以及強度如何。「一種口音」不算描述;「輕微的台灣國語」才是。以下都是描述原本使用的單行格式,只是在後面加上了口音:
| 你寫的內容 | 你要求的效果 |
|---|---|
| 低沈溫暖、語速從容、輕微的台灣國語 | 帶台灣腔的國語,語氣溫和、不疾不徐 |
| 明亮快速、香港腔國語、尾音短促 | 帶香港風味的國語,伴隨著那種節奏明快的語感 |
| 放鬆略帶沙啞、四川口音、口語化 | 帶四川味的國語,隨性自然而非刻意表演 |
| 中性標準國語,只有一點點東北味 | 標準國語,帶著極淡的地域色彩 |
| 語速平穩、聲音粗啞、輕柔的蘇格蘭腔調、從容不迫 | 帶著溫和蘇格蘭腔調的英文 |
| 溫暖緩慢、輕柔的美國南方拖腔 | 帶著美國南方拉長母音特點的英文 |
| 平淡疲憊、倫敦口音、短促 | 聽起來像倫敦人的英文,緊繃又帶倦意 |
| 輕快明亮、帶一點法國腔的英文 | 母語是法語的人說的英文 |
三個習慣讓效果更好。
這是三種不同的狀況,要設定在三個不同的地方。搞混它們就是腔調「沒作用」最常見的原因。
| 你想要的效果 | 設定位置 |
|---|---|
| 演員以專案的對話語言說話,但帶有地域腔調——例如台灣腔、香港腔、四川腔、東北腔、上海腔、北京兒化音,或是英語鄉村拖腔 | 角色的音色描述。台詞維持專案的對話語言,再疊加上該地域的腔調 |
| 台詞本身就是以該地域的用語撰寫——使用道地的地域說法,而非標準用法 | 劇本或 storyboard 台詞裡的對話本身。用語加上腔調,才能呈現出道地的方言感 |
| 演員說的是完全不同的語言——例如粵語、英語、日語 | 專案的對話語言設定,而非描述欄。那裡有提供粵語做為僅對話的選項。如何設定對話語言 |
| 某一句台詞要帶有生氣、低聲耳語、急促,或強調某個字 | 該句台詞開頭以括號標註的口氣備註。別在這裡重複寫腔調——角色已經有設定了。storyboard 中的對話 |
關鍵區分:腔調改變的是說話的方式,方言設定改變的是說的內容。在同一個地方要求兩者會互相衝突——在對話語言為國語的專案中,在描述裡寫「說粵語」,會讓模型對同一句台詞收到兩個互相矛盾的指令。如果你要粵語,請將對話語言設為粵語,再把任何地域色彩寫在描述裡做為加強。
| 你看到的狀況 | 發生原因 | 解決方式 |
|---|---|---|
| 儲存後完全沒有變化 | 該角色有附加音檔,因此實際演出不會使用描述內容 | 檢查標記;在角色卡片上使用刪除音色,然後重新生成該片段 |
| 腔調有出現但太微弱 | 強度用詞太模糊,或只有概略提到地區 | 更精確地描述並加強程度——例如「清晰、明顯的四川腔」——然後重新生成該片段 |
| 舊的 episode 聲音還是跟本來一樣 | 已完成的片段會保留生成時的聲音;這樣才能確保已交付的 episode 穩定不變 | 重新生成你想要加上腔調的片段。費用與第一次生成相同。每個片段修正的費用 |
| 事後修正的片段缺少腔調 | 已完成片段的聲音面板是使用音色庫中的預設音色來合成語音,因此描述裡寫的腔調不會套用上去 | 請重新生成片段,而不是重新配音。變更已有片段的聲音 |
| 聲音是對的,但不同片段之間會飄移 | 描述模式會犧牲一點一致性來換取彈性——每次生成都會重新詮釋文字 | 接受這個狀況,或將該角色改用音色庫的預設音色,放棄用文字設定該角色的腔調 |
| 角色的聲音正常,但陌生人的台詞聽起來很怪 | 演員名單以外的人說的台詞,不會套用角色的描述設定 | 幫那位說話者建立專屬的角色卡片,也寫上對應的腔調,或就當成一次性台詞保留原樣 |
在你想用「上傳音色」來解決這個問題之前,有件事要知道:附加的錄音與文字描述的腔調是二選一的替代方案,而非搭配使用。一旦附加音檔,描述內容(包含腔調文字)就不會被套用。想要特定地域聲音的會員,可刻意使用上傳功能來取代描述設定。角色音色的運作方式。
是的。音色描述會跟著該角色的每一句台詞,並依描述內容演出:影片模型會在同一個步驟中說出台詞並產生畫面,因此沒有單獨的配音步驟會導致腔調遺失。你不會有一個「強度設定」——如果腔調聽起來太輕,就更明確地描述,然後重新生成該片段。
幾乎都是因為角色有附加音檔:你匹配的預設音色,或是你上傳的錄音。只要有音檔存在,模型就不會依描述內容演出。請在角色卡片上使用「刪除音色」回到描述模式,然後重新生成該片段。
可以,之後生成的所有內容都會套用新的腔調。你已經製作好的片段會保留原本的聲音;若想在某些片段聽到新腔調,請重新生成這些片段,費用與一般生成片段相同。
不行。那個面板是使用音色庫的預設音色來合成語音,因此描述裡寫的腔調不會套用上去。腔調只會在重新生成的片段中出現。
不會。音色庫是依語言分類的——中文、英文、廣東話——配對是根據性別、年齡層與說話風格來選擇,並非依你描述裡的口音詞。口音只會來自音色描述。
不一樣。口音或方言會保留專案的對白語言,並帶有地域風味,因此要寫在音色描述裡。若要改變語言本身,請設定專案的對白語言,廣東話可做為僅對白的選項;如果對白語言維持國語,卻在描述裡寫「說廣東話」,等於同時要求兩件互相衝突的事。
不用。口音是角色的屬性,只要在音色描述裡寫一次,就會套用到該角色的所有台詞。會隨每一行變化的內容——情緒、語速、強調某個字——要寫在該行開頭括號內的台詞表現註記裡。
兩者都可以。每個角色都有自己的音色描述,因此口音不會互相干擾。僅有聲音的角色——旁白、電話另一頭的人——也有音色描述,口音對他們的台詞作用方式完全相同。
2026 年 10 月 10 日更新
價格方案·使用指南·作品範例·支援服務·隱私權政策·服務條款·法律資訊·聯絡我們·推廣夥伴計劃·© 2026 SceneMixer