AIによる複数キャラクターのシーン
2026年9月20日更新

生成動画には、1ショットに複数の人物が登場する場合に特有の失敗があります。本来いるはずのない顔が紛れ込んでしまうのです。テキストで言及されただけの人物——見られている、叫びかけられている、思い浮かべられている——が、その場で創作された顔で画面に現れます。これは、モデルが「その場にいる」と「言及されている」の違いを教えられていないからです。
そのため、ショットリストではショットごとに人物を明記します。各ショットにはフレーム内にいるキャラクターの明示的なリストがあり、文章でも前のショットの終了状態でもなく、このリストだけが、どのキャラクターの設定画を紐付けるかを決定します。
| フレーム内の人物 | ショットごとのリストです。1セグメント内の全ショットのリストの合計が、そのセグメントに送る設定画を決めます。 |
|---|---|
| 画面外の人物 | 「フレーム左方向に」「カメラに目線を合わせて」といった演出指示として記述し、名前は使いません。顔は一切紐付けられません。 |
| 1人だけのショット | 明示的に記載し、レンダラーにフレーム内が1人であることを伝え、余計な人物を創作させません。 |
| 話している人物 | セリフごとに名前で指定し、フレーム内の他の人物は口を閉じているとマークして、話者の口だけが動くようにします。 |
| 背景の群衆 | シーンの状態として明示的に宣言し、セグメントヘッダーに1回記述するか、または登場させません。環境音から暗黙的に推測されることはありません。 |
| 実用的な上限 | 1フレームに名前付きの人物が4人を超えると、品質が低下し始めます。ショットリストはこの上限を超えずに構成します。 |
これは理論ではなく、実測値です。画面外の敵役を名前で指定したショットでは、8回のレンダリング中5回で間違った顔や余分な人物が出現しました。同じショットを名前の代わりに演出指示で書き直したところ、12回のレンダリングでそうした失敗はゼロでした。そのため制作パイプラインでは書き換えを行います。1人だけのショットで、目線や移動方向としてしか存在しないキャラクターは空間的な表現に変換し、フレームリストから除外します。
同じロジックは死者にも適用されます。このセグメントで遺体としてしか言及されないキャラクターは、キャラクター参照ではなく通常の名詞として記述し、設定画が紐付けられて立ち上がってしまうことがないようにします。
撮り方は正確に2通りあり、リストでどちらかを選ぶ必要があります。横顔のツーショットか、肩越しのショットです。「AがBの方を向き、Bは背景でぼやけている」と書いてはいけません。BがAの被写界深度内にいるためにはAがBに背を向けている必要があり、通常のミディアムショットではそのカメラ位置は存在しないからです。それでも指定すると、レンダラーは1人をカメラ正面向きにし、もう1人をその後ろに立たせてしまいます。2人が実際に一緒にフレームに入る最初のショットで、アクションの軸は確定します。
300人の客がいる部屋はシーンの目に見える状態なので、そのように記述します。セグメントヘッダーに1行、背景の人物が誰で、どこにいて、何をしているかを書きます。これはそのシーンの全セグメントで一貫させます。この記述がなければ、ショットは群衆に一切言及できません。環境音の「客のざわめき」は視覚的な指示ではないため、それだけを伝えても、あるショットでは客が映り、次のショットでは会場が空になってしまうからです。
群衆が宣言されている場合、フレームの指示もそれに合わせて変わります。群衆は被写界深度内に収まりますが、フレーム内リストにカウントされるのは名前付きキャラクターだけのままです。
追加料金は不要です。これらはショットリストの機能であり、エピソードごとの文字数100文字あたり1クレジットで請求されます。設定画は、最初のプロジェクトの無料枠15枚を超えると1枚あたり7クレジットです。レンダリングは出力1秒あたり10クレジットからです。ショットをまたいで顔を一貫させる方法についてはキャラクターの一貫性を、料金については料金ページをご覧ください。
言語
以下の各シリーズはすべて同じパイプラインで制作されており、キャストはその言語をネイティブに話します。インターフェース、作業ドキュメント、話される台詞はすべて同じ言語で統一されており、吹き替えは一切使用していません。開いて実際に聞いてみてください。
A Carta de LisboaPortuguêsネイティブ台詞
윈터 프라미스한국어ネイティブ台詞
El Secreto de CostaEspañolネイティブ台詞
浪人の誓い日本語あなたの言語で
Ikrar JakartaBahasa Indonesiaネイティブ台詞
Зимняя коронаРусскийネイティブ台詞
L’Héritier du DéfiléFrançaisネイティブ台詞
Il Tavolo dell'OlivaItalianoネイティブ台詞
De Vuurtoren van de FjordNederlandsネイティブ台詞
العهد الصحراويالعربيةネイティブ台詞
Çantasındaki SözleşmeTürkçeネイティブ台詞
Die Istanbul-TäuschungDeutschネイティブ台詞
Останній сигналУкраїнськаネイティブ台詞
問劍青雲繁體中文ネイティブ台詞
The Last EnvelopeEnglishネイティブ台詞名前付きの人物が4人になるとキャラクターの同一性が崩れ始める実用的な上限であり、ショットリストはこれを超えないように作成されます。集団シーンは広いフレームで全員をまとめて撮るのではなく、シングルショットと肩越しショットで構成します。
それはまさにショットごとのフレームリストが防ぐ失敗です。見られているだけ、話しかけられているだけのキャラクターは名前ではなく演出指示として記述され、フレームリストには入りません。そのため設定画は紐付かず、顔が創作されることもありません。
はい、横顔のツーショットか肩越しショットで可能です。うまくいかないのは、片方がもう片方の方を向き、もう片方が背景でぼやけている構図です。このフレーミングと奥行きの組み合わせは物理的に不整合であり、指定するとカメラに向かって話す人物の後ろにもう1人が立っているような絵になってしまいます。
これらの情報はセグメントのヘッダーで一度だけ宣言されます——誰がどこで何をしているか——そしてそのシーン全体で一貫して保たれます。何も宣言されていない場合、そのショットに群衆は登場しません。周囲の群衆のノイズだけでは、視覚的な指示として扱われません。
各セリフの名前付き話者だけです。フレーム内のその他の人物は、唇が閉じていると明示的にマークされます。これにより、聞き手がセリフに合わせて黙って口を動かしてしまうことを防ぎます。
混雑したシーンを1つ生成して、顔の数を数えてみてください。
SceneMixerを無料で試すクレジットパッケージは$1.49から・Pro $7.99/月・開始時にクレジットカードは不要
料金プラン·ガイド·サンプル·サポート·プライバシーポリシー·利用規約·法的情報·お問い合わせ·© 2026 SceneMixer