SceneMixer
日本語
無料登録

AIによる複数キャラクターのシーン

AI複数キャラクターシーン生成ツール

2026年9月20日更新

簡単に説明すると:各ショットには、フレーム内にいる人物の明示的なリストがあり、そのリストだけがキャラクター設定画を紐付けます。そのため、見られているだけ、話しかけられているだけの人物は名前ではなく演出指示として扱われ、創作された顔で画面に登場することはありません。名前が指定された話者の口だけが動きます。背景の群衆はシーンで明示的に指定された場合のみ存在し、指定がなければ登場しません。1フレームに名前付きの人物が4人を超える場合は、シングルショット(1人ずつのショット)でシーンを構成します。
SceneMixerがエンドツーエンドで生成したAIショートドラマ『ラストシティ・ノックアウト』の静止画(キャラクター6人、1話)
サンプル:『ラストシティ・ノックアウト』 — 絵画風アニメ、1話、脚本からSceneMixerパイプラインでエンドツーエンド制作 · エピソードを見る

難しいのは人数ではなく、フレーム内に誰がいるかです

生成動画には、1ショットに複数の人物が登場する場合に特有の失敗があります。本来いるはずのない顔が紛れ込んでしまうのです。テキストで言及されただけの人物——見られている、叫びかけられている、思い浮かべられている——が、その場で創作された顔で画面に現れます。これは、モデルが「その場にいる」と「言及されている」の違いを教えられていないからです。

そのため、ショットリストではショットごとに人物を明記します。各ショットにはフレーム内にいるキャラクターの明示的なリストがあり、文章でも前のショットの終了状態でもなく、このリストだけが、どのキャラクターの設定画を紐付けるかを決定します。

概要

複数キャラクターショットの指定方法
フレーム内の人物ショットごとのリストです。1セグメント内の全ショットのリストの合計が、そのセグメントに送る設定画を決めます。
画面外の人物「フレーム左方向に」「カメラに目線を合わせて」といった演出指示として記述し、名前は使いません。顔は一切紐付けられません。
1人だけのショット明示的に記載し、レンダラーにフレーム内が1人であることを伝え、余計な人物を創作させません。
話している人物セリフごとに名前で指定し、フレーム内の他の人物は口を閉じているとマークして、話者の口だけが動くようにします。
背景の群衆シーンの状態として明示的に宣言し、セグメントヘッダーに1回記述するか、または登場させません。環境音から暗黙的に推測されることはありません。
実用的な上限1フレームに名前付きの人物が4人を超えると、品質が低下し始めます。ショットリストはこの上限を超えずに構成します。

画面外のキャラクターを名前で書くとショットが台無しになる理由

これは理論ではなく、実測値です。画面外の敵役を名前で指定したショットでは、8回のレンダリング中5回で間違った顔や余分な人物が出現しました。同じショットを名前の代わりに演出指示で書き直したところ、12回のレンダリングでそうした失敗はゼロでした。そのため制作パイプラインでは書き換えを行います。1人だけのショットで、目線や移動方向としてしか存在しないキャラクターは空間的な表現に変換し、フレームリストから除外します。

同じロジックは死者にも適用されます。このセグメントで遺体としてしか言及されないキャラクターは、キャラクター参照ではなく通常の名詞として記述し、設定画が紐付けられて立ち上がってしまうことがないようにします。

向かい合う2人

撮り方は正確に2通りあり、リストでどちらかを選ぶ必要があります。横顔のツーショットか、肩越しのショットです。「AがBの方を向き、Bは背景でぼやけている」と書いてはいけません。BがAの被写界深度内にいるためにはAがBに背を向けている必要があり、通常のミディアムショットではそのカメラ位置は存在しないからです。それでも指定すると、レンダラーは1人をカメラ正面向きにし、もう1人をその後ろに立たせてしまいます。2人が実際に一緒にフレームに入る最初のショットで、アクションの軸は確定します。

群衆は宣言するか、登場させないかのどちらか

300人の客がいる部屋はシーンの目に見える状態なので、そのように記述します。セグメントヘッダーに1行、背景の人物が誰で、どこにいて、何をしているかを書きます。これはそのシーンの全セグメントで一貫させます。この記述がなければ、ショットは群衆に一切言及できません。環境音の「客のざわめき」は視覚的な指示ではないため、それだけを伝えても、あるショットでは客が映り、次のショットでは会場が空になってしまうからです。

群衆が宣言されている場合、フレームの指示もそれに合わせて変わります。群衆は被写界深度内に収まりますが、フレーム内リストにカウントされるのは名前付きキャラクターだけのままです。

対応していないこと

料金

追加料金は不要です。これらはショットリストの機能であり、エピソードごとの文字数100文字あたり1クレジットで請求されます。設定画は、最初のプロジェクトの無料枠15枚を超えると1枚あたり7クレジットです。レンダリングは出力1秒あたり10クレジットからです。ショットをまたいで顔を一貫させる方法についてはキャラクターの一貫性を、料金については料金ページをご覧ください。

言語

15言語のネイティブ台詞

以下の各シリーズはすべて同じパイプラインで制作されており、キャストはその言語をネイティブに話します。インターフェース、作業ドキュメント、話される台詞はすべて同じ言語で統一されており、吹き替えは一切使用していません。開いて実際に聞いてみてください。

全15言語を見る

よくある質問

1ショットに何人までのキャラクターを入れられますか?

名前付きの人物が4人になるとキャラクターの同一性が崩れ始める実用的な上限であり、ショットリストはこれを超えないように作成されます。集団シーンは広いフレームで全員をまとめて撮るのではなく、シングルショットと肩越しショットで構成します。

言及しただけのキャラクターが画面に現れたのはなぜですか?

それはまさにショットごとのフレームリストが防ぐ失敗です。見られているだけ、話しかけられているだけのキャラクターは名前ではなく演出指示として記述され、フレームリストには入りません。そのため設定画は紐付かず、顔が創作されることもありません。

2人のキャラクターが向かい合って話すことはできますか?

はい、横顔のツーショットか肩越しショットで可能です。うまくいかないのは、片方がもう片方の方を向き、もう片方が背景でぼやけている構図です。このフレーミングと奥行きの組み合わせは物理的に不整合であり、指定するとカメラに向かって話す人物の後ろにもう1人が立っているような絵になってしまいます。

背景のエキストラはどのように扱われますか?

これらの情報はセグメントのヘッダーで一度だけ宣言されます——誰がどこで何をしているか——そしてそのシーン全体で一貫して保たれます。何も宣言されていない場合、そのショットに群衆は登場しません。周囲の群衆のノイズだけでは、視覚的な指示として扱われません。

誰が口を動かすのか?

各セリフの名前付き話者だけです。フレーム内のその他の人物は、唇が閉じていると明示的にマークされます。これにより、聞き手がセリフに合わせて黙って口を動かしてしまうことを防ぎます。

キャストしていない人物はフレーム内に存在しません

混雑したシーンを1つ生成して、顔の数を数えてみてください。

SceneMixerを無料で試す

クレジットパッケージは$1.49から・Pro $7.99/月・開始時にクレジットカードは不要

料金プラン·ガイド·サンプル·サポート·プライバシーポリシー·利用規約·法的情報·お問い合わせ·© 2026 SceneMixer