SceneMixer
日本語
無料登録

AIキャラクターボイス

AIキャラクターボイス

2026年9月16日更新

簡単に説明すると:SceneMixerでは、セリフを後から吹き替えることはありません。動画モデルが映像と音声を同時に生成するため、キャラクターの口の動きとセリフは同じ生成処理で作られます。設定できるのはどの声を使うかです。各キャラクターには、声質や話し方の文章による説明、プリセットボイスライブラリからマッチングしたサンプル、または自身でアップロードしたサンプルのいずれかを設定できます。権利のない声をクローンする機能は提供していません。
SceneMixerがエンドツーエンドで生成したAIショートドラマ『ネオン・デット』の静止画(キャラクター7人、1話)
サンプル:『ネオン・デット』 — ゲームエンジン写実、1話、脚本からSceneMixerパイプラインでエンドツーエンド制作 · エピソードを見る

声が実際にどこから来るのか

ほとんどのAI動画ワークフローでは、音声は後工程として扱われます。まず無音の映像を生成し、セリフを合成してから、リップシンクを合わせる作業が発生します。ここで使われる動画モデルは音声と映像を1回の処理で生成するため、この手間はなくなりますが、「声の設定」の意味合いが変わります。これは台本を入力して使う音声合成エンジンではなく、生成処理の条件となる参照情報なのです。

キャラクターに声を設定する3つの方法
文章による説明年齢、声質、声の太さ、話し方などを指定します。キャラクターの他の要素と同じく台本から生成され、動画モデルによって演じられます。
マッチングされたプリセットシステムボイスのライブラリから声を選びます。各ボイスには試聴可能な短い音声サンプルが付いています。モデル呼び出し1回で、性別、言語、年齢をもとにキャラクターごとにマッチする声が提案されます。再マッチングしたり、手動で別の声を選んだりすることも可能です。
自身のサンプルキャラクター用の音声をアップロードすると、そのキャラクターが登場するすべてのセグメントで、その音声が声の参照として使われます。

設定した声は一貫して使用されます。同じキャラクターの顔が変わらないのと同じ理由で、すべてのセグメント、すべてのエピソードで同じ声で話します。参照情報がキャラクターに紐づいているからです。

提供しない機能とその理由

他人の録音から声をクローンするツールは用意していません。これはロードマップに載っていない意図的な制限です。私たちがサービスを提供するほとんどの市場では、実在する人物の声を使った合成パフォーマンスを公開することは肖像権の問題になります。ワンクリックでそれができる製品は、その行為を常態化させてしまいます。私たちのコンプライアンスチェックリストでは、顔であれ声であれ、肖像は公開前に使用権限を得ている必要があるものとして扱っています。

この制限から明確にお伝えしておくべき2点があります:

言語は別の設定です

セリフの言語はステップ1で選択し、プロジェクト全体に適用されます。分析段階でその言語でセリフが書かれ、絵コンテにそのまま記載され、その言語で演じられます。これは英語の原版に対する吹き替え処理ではありません。英語の原版自体が存在しないのです。対象地域の設定により、キャスト、名前、舞台設定を同時に該当する市場に合わせることができます。15言語に対応しており、なぜセリフを生成する方が後からタイミングを合わせる吹き替えより優れているかについては、吹き替えを推奨しない理由で詳しく説明しています。

料金について

ボイスマッチングは無料のモデル呼び出しです。クレジットを消費せず、同時実行タスクの制限にもカウントされません。自身のサンプルのアップロードも無料です。音声自体は動画生成の一部として生成され、料金は出力1秒あたり10クレジットから(最低クレジット単価では約$0.06/秒)。音声に対して1単語ごと、1文字ごとの個別料金は発生しません。詳細は料金ページ、または生成処理の中で声の設定がどの位置にあるかについてはジェネレーター概要をご覧ください。

現在できないこと

全エピソードを15言語で

セリフの言語はステップ1で一度設定すると、生成全体がその言語で実行されます。同時に対象地域の設定により、名前、顔、街並みがその市場に合わせて調整されます。以下の各サンプルはこの方法で、言語ごとに1つずつ制作されたものです。

言語

15言語のネイティブ台詞

以下の各シリーズはすべて同じパイプラインで制作されており、キャストはその言語をネイティブに話します。インターフェース、作業ドキュメント、話される台詞はすべて同じ言語で統一されており、吹き替えは一切使用していません。開いて実際に聞いてみてください。

全15言語を見る

よくある質問

SceneMixerは声をクローンできますか?

いいえ。声はサンプリングされたプリセットボイスのライブラリからマッチングするか、自身の音声をアップロードして提供していただきます。他人の録音から声を複製する方法は意図的に用意していません。未実装なのではなく、意図した仕様です。

セリフは動画の後から吹き替えられるのですか?

いいえ。動画モデルは映像と音声を同じ処理で生成するため、演技と口の動きは1回の生成で作られます。セリフを変更する場合に音声トラックを編集するのではなく、そのセグメントを再生成する必要があるのもこのためです。

自分の声をアップロードできますか?

はい。キャラクター用のサンプルをアップロードすると、そのキャラクターが話すすべてのセグメントで、その音声が声の参照として使われます。

全員のキャラクターが同じ言語を話す必要がありますか?

セリフの言語はプロジェクトレベルの設定のため、1つのプロジェクト内ではそうなります。ただし言語は、台本を書いた言語や、インターフェースの言語とは独立して選択できます。設定を変えて実行することで、1つの台本を複数の市場向けに制作できます。

エピソードをまたいで声は同じままですか?

はい。顔が変わらないのと同じ理由です。キャラクターに設定された声はプロジェクトレベルで紐づけられ、そのキャラクターが話すすべてのセグメントに引き継がれます。

吹き替えるクリップではなく、話すキャラクターを

視聴者が話す言語で、映像と演技を1回の処理で生成します。

SceneMixerを無料で試す

クレジットパッケージは$1.49から ・Pro $7.99/月 ・クレジットカード不要で始められます

料金プラン·ガイド·サンプル·サポート·プライバシーポリシー·利用規約·法的情報·お問い合わせ·© 2026 SceneMixer