SceneMixer
繁體中文
免費註冊

在 AI 短劇中為角色加上口音或方言

快速說明: 每個角色都有 音色描述——一行自由填寫的文字,說明聲音聽起來的樣子。把口音寫進去就對了。這行描述會跟著角色的每一句台詞,影片模型在生成鏡頭時會依此執行,所以在描述裡寫 輕微的台灣國語,角色從第一句台詞開始就會帶著輕微台灣腔。成不成功取決於一件事:角色必須 沒有附加音頻。如果已經匹配了預設音色或上傳了錄音,描述就不會被使用,寫在裡面的口音也毫無作用。生成前請先檢查標記——只要花十秒,卻是成功與否的關鍵。角色音色的運作方式。
AI 短劇《鏽城擊破》劇照,由 SceneMixer 端到端生成(6 位角色、1 集)
範例:《鏽城擊破》— 厚塗光影動畫,1 集,由 SceneMixer 從劇本端到端產出 · 觀看集數

在步驟 2 開啟角色,音色描述 欄位會在對話框底部、外觀描述的下方。口音就是寫在這個欄位裡。

口音如何呈現在畫面上

聲音完全不是事後錄製、配音或拼接起來的。生成片段時,影片模型會在同一個程序中產生畫面並說出台詞,每個說話角色的描述都會做為該聲音的需求提示交給模型。這就是為什麼嘴型會和台詞吻合:聲音是生成的一部分,而非後加上去的圖層。對白與聲音在同一次生成中完成。

描述口音的文字不會被過濾、縮短或刪除:「聲音溫柔帶氣音、輕微的台灣國語、語速從容」會跟著這個角色在每個片段的每一句台詞——系統也不會質疑你是不是認真的。想要香港腔國語,就直接寫香港腔國語。

音色庫唯一做不到的就是口音。音色庫是依語言分類——中文、英文、廣東話——再依性別、年齡層和語氣來挑選匹配。沒有台灣腔選項、沒有蘇格蘭腔選項、沒有布魯克林腔選項,你描述裡的口音用字也不會影響音色的挑選。口音來自描述;音色庫的功用是維持聲音穩定。角色音色的運作方式。

四步驟加上口音

  1. 開啟角色。 在步驟 2 的 角色和場景 中,點擊角色卡片。同一個欄位也存在於集數編輯器的角色詳細資料中;兩處是同一個描述,會跟著角色出現在專案各個地方。
  2. 輸入前先看音色列。 如果顯示 自動匹配音色、從音色庫選擇 和 上傳音色,代表這個角色沒有音頻——這正是你要的狀態,你下一步寫的所有內容都會被使用。如果已經附加了音色,請先參考下方的標記檢查方式。
  3. 把口音加進音色描述。 保留原本的內容——音色、語速、語氣——再把口音加在最後。這個欄位可以寫一到兩個完整句子,沒有長度限制,通常一句就夠了。
  4. 儲存並生成。 口音會從下次生成開始套用在這個角色的每一句台詞上。

檢查標記:描述是否有被使用?

有兩個地方可以看出角色處於哪種模式。在步驟 2 的角色卡片上,如果附加了音頻音色,名字旁邊會有一個小喇叭圖示——沒有圖示就代表由描述主控。在故事板編輯器中,@ 選單的 音色 分頁會列出所有角色:每個角色都有說話圖示,沒有音頻的角色旁邊還會有一個小小的 僅描述 標籤。將滑鼠停在圖示上會顯示是哪一種狀態——已指派音色,或是 僅音色描述(無音頻)。沒有標籤的圖示代表綠燈通行;有喇叭則代表附加了音頻樣本,包含口音在內的描述都不會被執行。

如果你發現狀態不對,開啟角色並使用 刪除音色——確認提示會說遠端檔案會保留,所以不會刪除任何東西,之後你還是可以再選取音色。這是免費的,而且會在你下次生成的片段生效。接著你的口音描述就會重新作用。

該寫什麼,又會得到什麼效果

說明是哪種口音,以及強度如何。「一種口音」不算描述;「輕微的台灣國語」才是。以下都是描述原本使用的單行格式,只是在後面加上了口音:

你寫的內容你要求的效果
低沈溫暖、語速從容、輕微的台灣國語帶台灣腔的國語,語氣溫和、不疾不徐
明亮快速、香港腔國語、尾音短促帶香港風味的國語,伴隨著那種節奏明快的語感
放鬆略帶沙啞、四川口音、口語化帶四川味的國語,隨性自然而非刻意表演
中性標準國語,只有一點點東北味標準國語,帶著極淡的地域色彩
語速平穩、聲音粗啞、輕柔的蘇格蘭腔調、從容不迫帶著溫和蘇格蘭腔調的英文
溫暖緩慢、輕柔的美國南方拖腔帶著美國南方拉長母音特點的英文
平淡疲憊、倫敦口音、短促聽起來像倫敦人的英文,緊繃又帶倦意
輕快明亮、帶一點法國腔的英文母語是法語的人說的英文

三個習慣讓效果更好。

腔調、方言,還是不同語言?

這是三種不同的狀況,要設定在三個不同的地方。搞混它們就是腔調「沒作用」最常見的原因。

你想要的效果設定位置
演員以專案的對話語言說話,但帶有地域腔調——例如台灣腔、香港腔、四川腔、東北腔、上海腔、北京兒化音,或是英語鄉村拖腔角色的音色描述。台詞維持專案的對話語言,再疊加上該地域的腔調
台詞本身就是以該地域的用語撰寫——使用道地的地域說法,而非標準用法劇本或 storyboard 台詞裡的對話本身。用語加上腔調,才能呈現出道地的方言感
演員說的是完全不同的語言——例如粵語、英語、日語專案的對話語言設定,而非描述欄。那裡有提供粵語做為僅對話的選項。如何設定對話語言
某一句台詞要帶有生氣、低聲耳語、急促,或強調某個字該句台詞開頭以括號標註的口氣備註。別在這裡重複寫腔調——角色已經有設定了。storyboard 中的對話

關鍵區分:腔調改變的是說話的方式,方言設定改變的是說的內容。在同一個地方要求兩者會互相衝突——在對話語言為國語的專案中,在描述裡寫「說粵語」,會讓模型對同一句台詞收到兩個互相矛盾的指令。如果你要粵語,請將對話語言設為粵語,再把任何地域色彩寫在描述裡做為加強。

腔調沒有顯示出來時

你看到的狀況發生原因解決方式
儲存後完全沒有變化該角色有附加音檔,因此實際演出不會使用描述內容檢查標記;在角色卡片上使用刪除音色,然後重新生成該片段
腔調有出現但太微弱強度用詞太模糊,或只有概略提到地區更精確地描述並加強程度——例如「清晰、明顯的四川腔」——然後重新生成該片段
舊的 episode 聲音還是跟本來一樣已完成的片段會保留生成時的聲音;這樣才能確保已交付的 episode 穩定不變重新生成你想要加上腔調的片段。費用與第一次生成相同。每個片段修正的費用
事後修正的片段缺少腔調已完成片段的聲音面板是使用音色庫中的預設音色來合成語音,因此描述裡寫的腔調不會套用上去請重新生成片段,而不是重新配音。變更已有片段的聲音
聲音是對的,但不同片段之間會飄移描述模式會犧牲一點一致性來換取彈性——每次生成都會重新詮釋文字接受這個狀況,或將該角色改用音色庫的預設音色,放棄用文字設定該角色的腔調
角色的聲音正常,但陌生人的台詞聽起來很怪演員名單以外的人說的台詞,不會套用角色的描述設定幫那位說話者建立專屬的角色卡片,也寫上對應的腔調,或就當成一次性台詞保留原樣

費用說明

在你想用「上傳音色」來解決這個問題之前,有件事要知道:附加的錄音與文字描述的腔調是二選一的替代方案,而非搭配使用。一旦附加音檔,描述內容(包含腔調文字)就不會被套用。想要特定地域聲音的會員,可刻意使用上傳功能來取代描述設定。角色音色的運作方式。

常見問題

寫腔調描述真的會改變角色的說話方式嗎?

是的。音色描述會跟著該角色的每一句台詞,並依描述內容演出:影片模型會在同一個步驟中說出台詞並產生畫面,因此沒有單獨的配音步驟會導致腔調遺失。你不會有一個「強度設定」——如果腔調聽起來太輕,就更明確地描述,然後重新生成該片段。

為什麼我的腔調完全沒作用?

幾乎都是因為角色有附加音檔:你匹配的預設音色,或是你上傳的錄音。只要有音檔存在,模型就不會依描述內容演出。請在角色卡片上使用「刪除音色」回到描述模式,然後重新生成該片段。

我已經生成好 episode 了,還能再加腔調嗎?

可以,之後生成的所有內容都會套用新的腔調。你已經製作好的片段會保留原本的聲音;若想在某些片段聽到新腔調,請重新生成這些片段,費用與一般生成片段相同。

我可以從已完成片段的聲音面板加上腔調嗎?

不行。那個面板是使用音色庫的預設音色來合成語音,因此描述裡寫的腔調不會套用上去。腔調只會在重新生成的片段中出現。

音色庫裡有地域腔調的選項嗎?

不會。音色庫是依語言分類的——中文、英文、廣東話——配對是根據性別、年齡層與說話風格來選擇,並非依你描述裡的口音詞。口音只會來自音色描述。

口音等同於對白語言嗎?

不一樣。口音或方言會保留專案的對白語言,並帶有地域風味,因此要寫在音色描述裡。若要改變語言本身,請設定專案的對白語言,廣東話可做為僅對白的選項;如果對白語言維持國語,卻在描述裡寫「說廣東話」,等於同時要求兩件互相衝突的事。

我需要在每一行台詞都重複寫口音嗎?

不用。口音是角色的屬性,只要在音色描述裡寫一次,就會套用到該角色的所有台詞。會隨每一行變化的內容——情緒、語速、強調某個字——要寫在該行開頭括號內的台詞表現註記裡。

兩個角色可以有不同的口音嗎?從未露面的角色呢?

兩者都可以。每個角色都有自己的音色描述,因此口音不會互相干擾。僅有聲音的角色——旁白、電話另一頭的人——也有音色描述,口音對他們的台詞作用方式完全相同。

幫角色設定道地的口音

打開角色設定,確認標記,並在音色描述中加入一句口音描述。

打開編輯器

2026 年 10 月 10 日更新

價格方案·使用指南·作品範例·支援服務·隱私權政策·服務條款·法律資訊·聯絡我們·推廣夥伴計劃·© 2026 SceneMixer