一貫したキャラクター
2026年9月20日更新

テキストトゥビデオモデルは、生成ごとに独立してレンダリングします。1カット目で「眉に傷のある30代の女性」と記述し、30カット目でも同じように記述しても、説明文には一致するけれど互いには似ていない2人の女性が出力されます—形容詞だけでは顔を特定しきれないのです。以下に挙げる解決策はすべて、根本の考え方は同じです。キャラクターを言葉で説明するのをやめ、モデルに本人の写真を渡すのです。
| 設定画 | 各キャラクターは、無地の背景、方向性のあるキーライトのもと、9:16の全身設定画として一度だけ生成されます。これはムード作品ではなくキャスティング写真です。設定画に焼き付いた光は、それを使うすべてのカットに引き継がれるからです。 |
|---|---|
| 添付クロップ | その設定画から切り出した顔と体のクロップを、キャラクターが登場するすべてのセグメントに添付して送信します。モデルは説明文を解釈するのではなく、写真をもとに一致させます。 |
| IDによる紐付け | 絵コンテ台本は名前ではなくIDでアセットを参照します。同名のキャラクターがいたり、プロジェクト途中で名前を変更したりしても、連鎖が黙って壊れることがなくなります。 |
| オフスクリーンルール | 見つめられている、話しかけられている、手を伸ばされているだけでフレーム内にいないキャラクターは、演出として記述し、決して名前で呼びません。不在のキャラクターを名指しすると、モデルが1人だけのカットにその顔を貼り付けてしまう原因になります。 |
5つ目の小さな仕組みとして、1カット内の各人物には、その人物の説明文から抽出した1〜2個の識別しやすい顔の特徴を持たせます。これにより、同じ制服を着た2人のキャラクターがカット途中で顔を入れ替えてしまう古典的な失敗を緩和します。
一貫性は「まったく変わらない」ことを意味するわけではありません。第6話で火だるまになったキャラクターは、第7話で火傷して見えなければなりません。境界線は、動画モデルが参照画像をどう扱うかで決まります。モデルは顔、服装、形状、構造をほぼ忠実にコピーし、光、天気、時間帯はその上に重ねるエフェクトとして適用します。
この判断を逆にしてしまうと、どちらの方向でもコストがかさみます。「カップを持つ」ためのバリアントは、料金を払って生成しても本編には映らない無駄な画像になりますし、「火事の後」をプロンプトで指示しても、モデルは参照画像にあるきれいな部屋を優先して、その指示を丁重に無視します。
各レイヤーが何をカバーでき何をカバーできないかについての詳細な階層的な説明は、キャラクター一貫性ガイドに記載しています。
設定画は台本分析(英語テキスト3,333文字あたり4クレジット)とは別の独立した項目です。各アカウントには無料の参照画像が15枚付属し、それを超える追加画像や再生成画像は、デフォルトの画像モデルで1枚あたり7クレジットです。状態バリアントには初回プロジェクト限定の小さな無料枠があり、その後は画像として課金されます。動画自体は、参照画像の有無にかかわらず、出力1秒あたり10クレジットから(最低クレジット単価では約$0.06/秒)です。一貫性のための追加料金はかかりません。詳細は料金ページをご覧ください。
この分野で「一貫性がある」という主張は、絶対に鵜呑みにすべきではありません。その必要もありません。新規アカウントには、50クレジット、キャラクター・シーン・小道具全体で15枚の無料参照画像、初回プロジェクトで第1話の絵コンテが1本無料、さらに自分の設定画を使って自分のエピソードのオープニングショットをレンダリングする最大5秒の無料プレビューが1回付いています。これだけあれば実際にテストできます:
参考までに:このプラットフォームのプロジェクトの中央値は名前のあるキャラクターが5人で、10プロジェクト中9プロジェクトは10人未満です。もしあなたのストーリーに30人必要でも、同じ仕組みがそのまま使えます—コストがかかるのは設定画であって、一貫性の維持ではありません。
セリフの言語はステップ1で一度設定すると、生成全体に適用されます。対象地域の設定により、登場人物の名前、顔、街並みも同時にその市場向けに調整されます。以下の各サンプルはこの方法で言語ごとに1つずつ作成されています。
言語
以下の各シリーズはすべて同じパイプラインで制作されており、キャストはその言語をネイティブに話します。インターフェース、作業ドキュメント、話される台詞はすべて同じ言語で統一されており、吹き替えは一切使用していません。開いて実際に聞いてみてください。
A Carta de LisboaPortuguêsネイティブ台詞
윈터 프라미스한국어ネイティブ台詞
El Secreto de CostaEspañolネイティブ台詞
浪人の誓い日本語あなたの言語で
Ikrar JakartaBahasa Indonesiaネイティブ台詞
Зимняя коронаРусскийネイティブ台詞
L’Héritier du DéfiléFrançaisネイティブ台詞
Il Tavolo dell'OlivaItalianoネイティブ台詞
De Vuurtoren van de FjordNederlandsネイティブ台詞
العهد الصحراويالعربيةネイティブ台詞
Çantasındaki SözleşmeTürkçeネイティブ台詞
Die Istanbul-TäuschungDeutschネイティブ台詞
Останній сигналУкраїнськаネイティブ台詞
問劍青雲繁體中文ネイティブ台詞
The Last EnvelopeEnglishネイティブ台詞シリーズ全体で同じ顔を保つことが設計目標であり、アセットライブラリ内のキャストに対して設定画の仕組みが実現する機能です。ただし、全フレームで完全に保証されるわけではありません。同じ服装のキャラクターが同じショットに映る場合や、設定画の大部分がコートで占められているキャラクターは、依然として難しいケースです。それ以外の要素——エピソード数、経過時間、キャラクターが登場するショット数——は一貫性を低下させません。すべてのショットが同じ画像と照合されるからです。
はい。どの設定画もアップロードした画像に置き換えることができ、パイプラインの残りの部分は生成されたものとまったく同じように扱います。これは、他ですでにデザインしたキャラクターを使うための方法です。
技術的には、アップロード機能は画像が何であるかを問いません。しかし、実在の人物の容姿を使ったAI動画を公開することは、ほとんどの市場で法的な問題となり、当社のコンプライアンスガイドでもそのように扱っています。フェイススワップツールは提供していませんし、推奨もしていません。
何も壊れません。絵コンテは識別子でアセットを参照しており、名前の変更は保存されたテキスト全体に同時に反映されます。2026年9月より前は名前で参照を照合していましたが、この変更によってその問題は完全に解消されました。
いいえ。セグメントに設定画を添付しても、1秒あたりの料金は変わりません。各設定画につき1度支払うだけで、その後は何ショット使っても追加料金はかかりません。一貫性はここではアーキテクチャによる機能であり、アップセルの対象ではありません。
いいえ、そうすべきではありません。ショットのテキストにはキャラクター名を記載し、外見は設定画が保持します。ショットのテキストで身体的な特徴を繰り返し記述すると、モデルが画像から離れて言葉の方に引き戻されてしまいます。この設計は、まさにそのブレを解消するためのものです。
はい——そのために状態バリアントがあります。各外見はそれぞれ独立した参照画像であり、絵コンテはセグメントごとにどれを適用するかを決定します。エピソード全体ではなく、個々のセグメント単位で指定できます。
キャストは一度生成すれば、その後のすべてのショットは説明文ではなく画像と照合されます。
SceneMixerを無料で試すクレジットパッケージは$1.49から · Pro $7.99/月 · クレジットカード不要で始められます
料金プラン·ガイド·サンプル·サポート·プライバシーポリシー·利用規約·法的情報·お問い合わせ·© 2026 SceneMixer