指南 · 語言
更新於 September 12, 2026

| 問題 | 使用配音 | 使用母語生成 |
|---|---|---|
| 嘴型動作 | 屬於原始語言;靠對嘴工具近似模擬 | 跟臺詞一起生成;音訊與畫面一次完成 |
| 鏡頭長度 | 由原始版本固定;譯文較長就會被趕節奏或剪掉 | 在生成鏡頭前,就依目標語言的語速計算 |
| 停頓與換氣 | 沿用原始表演的節奏 | 依目標語言臺詞的需求安排位置 |
| 情緒 | 由配音員或 TTS 聲音演出,搭配的卻是無關的臉部表情 | 由繪製臉部的同一次生成一併演出 |
| 修正成本 | 要重錄、重新對齊臺詞;有時還得重剪鏡頭 | 重新生成單一片段;只計算該片段的費用 |
同一句話在不同語言的長度並不一樣。SceneMixer 的分鏡步驟會依語速推算鏡頭長度——英文大約每秒 3 個字、中文大約每秒 5 個字,其他語言則對應到這些比例尺——而且這件事是在任何影片生成之前,依對話語言個別計算。配音工作流程做不到這點:它的鏡頭長度早就被來源語言固定了,這也是為什麼配音短劇的德文版本常聽起來很趕、中文版本又常覺得拖。
除此之外——不論是新影集、市場上市、試播集——都請直接用該語言生成表演。請參閱15 種語言總覽以及如何設定對話語言並在地化演員陣容。
不是。AI 配音是替換已完成片段的音訊,然後試著對嘴。母語生成則是在鏡頭還不存在時,就把目標語言的臺詞交給影片模型,因此嘴型動作、停頓和鏡頭長度都是為該語言產生的。
因為同一句話在每種語言花的時間都不同。SceneMixer 會在生成影片前,依選定對話語言的語速計算鏡頭長度;配音片段則只能沿用來源語言的鏡頭長度。
每個角色都會對應一組預設聲音樣本,附加在每個片段上,因此角色的聲音身分跨集數會保持穩定。跨語言時,音色會維持可辨識,同時以新語言生成表演。
不需要支付配音流程的費用。不論哪種語言,片段消耗的 credits 都相同;臺詞錯了只要重新生成那一個片段即可。
只要選一次對話語言;每個片段都會用該語言演出、依該語言調整節奏,而且可以一次修正一個片段。
免費註冊語速數值為 SceneMixer 分鏡時序功能截至 2026-09-12 所使用的常數。