SceneMixer
日本語
無料登録

衣装の一貫性

AIによる衣装・服装の一貫性

2026年9月20日更新

簡潔な回答:服装はキャラクターの設定画で一度定義すれば、そのキャラクターが登場するすべてのショットに引き継がれます。ショットごとに衣装を記述し直してはいけません。顔の描写と競合し、カメラが後ろに下がって頭が点のように小さくなってしまうからです。実際に衣装を替える場合は新しい設定画を作成します。雨や泥、襟がゆるんだ様子などはテキストで記述します。参照画像を使うモデルは画像内の要素を忠実に複製する一方で、その上に重ねる効果はテキストで受け入れるからです。
SceneMixerがエンドツーエンドで生成したAIショートドラマ『浪人の誓い』の静止画(キャラクター7人、1話)
サンプル:『浪人の誓い』 — フィルム調実写、1話、脚本からSceneMixerパイプラインでエンドツーエンド制作 · エピソードを見る

衣装は一度定義したら、あとは参照するだけ

ついすべてのショットで服を描写したくなりますが、これは間違いであり、コストもかさみます。ショットのプロンプトに衣装の説明を長く書くと、モデルの注意が顔から逸れ、縦長のフレームではカメラが大きく後ろに下がって頭が縮小し、キャラクターの同一性が失われます。薄いオーバーコートがフレームの7割を占め、その上に小さな顔が乗っているだけ、というのは机上の話ではなく実際によく起こる失敗です。

そのため、服装はキャラクターの設定画に記載し、各ショットでは人物を参照するだけにとどめます。設定画で定義した内容は、すべてのショットに引き継がれます。

要点

衣装を決める場所
設定画1つの衣装を、カット・生地・構造・留め具といった原因となる要素で記述し、白背景のキャスティング写真として生成します。
衣装の軸時代、仕立ての伝統、生地、工芸といったプロジェクト全体の基準を解析時に一度だけ注入し、登場人物全員が同じ世界観の服装をまとうようにします。
2着目の衣装専用の設定画を作成します。ショット内の一文として書くのではなく、キャラクターの状態として扱います。
小さな変化雨、埃、襟のゆるみ、手に持っている物などはショット内にテキストで記述します。追加の画像は不要です。
ショットプロンプトキャラクターを参照します。衣装を記述し直したり、服を見せるためにカメラを後退させたりしません。

状態と文章の境界線

2枚目の画像が必要かどうかを決めるこの線引きは、参照条件付き動画モデルの動作に基づいています。モデルは画像内にあるもの(顔、衣装、小物、構造)をほぼそのまま複製し、画像の上に重なる全体的な効果(天気、時間帯、光、汚れ)はテキストとして受け入れます。

画像を増やしすぎる方向でこの線引きを誤るのはよくあるミスです。初期の自動検出では、カップを持つ、ランプに火が灯るといったものまで「状態」として検出されがちでしたが、これらはテキストで十分です。現在のパイプラインがキャラクターごとに提案する状態の数に上限を設けているのは、状態画像を過剰に生成するとコストがかかる割にメリットがないからです。

1つの記述に2つの衣装を書く

脚本ではキャラクターの衣装を弧として描くことがよくあります。初期エピソードはこの服、後半はあの服、さらに結婚式の衣装、といった具合です。この3つをまとめて1つの記述として渡すと、レンダリング時にそれぞれの要素を半分ずつまとった人物が描かれてしまいます。そのため、画像を生成する前に構造的に記述を分割します。最初の衣装は基本設定画に残し、残りは個別の状態画像とします。履物、小物、生地といったパーツのラベルは、2着目の衣装ではなく1つの衣装の構成要素として認識されます。

各ショットが使用する画像

ショットごとの優先順位は次のとおりです:そのセグメント専用に選ばれた状態、エピソード単位の上書き画像、そのエピソードに割り当てられた状態、基本設定画。実際にレンダリングされた状態のみが有効です。紙の上では状態が存在しても画像がない場合、ショットは基本設定画にフォールバックし、差分をテキストで補うため、画像がなくても変化自体は記述されます。

割り当ては自動で行われます。ショットリスト生成後、どのセグメントがどの状態を使うかを判定して記録するパスが走ります。これは意図的にエピソード単位ではなくセグメント単位で行われます。回想シーンの衣装をエピソード全体に適用すると、そのエピソード内のすべてのショットでキャラクターが誤った服を着てしまうからです。

対応していないこと

コストについて

各状態画像は生成画像1枚分で、7クレジットが必要です。最初のプロジェクトには、キャラクター・場所・小物を合わせて15枚の無料設定画が含まれており、状態画像には最初のプロジェクト内で別途無料枠があるため、試しに作成する分には費用がかかりません。テキストのみの変更はまったく無料です。これが、状態と文章の線引きを覚える価値がある主な理由です。基本画像の作成方法についてはキャラクターシートを、料金については料金ページをご覧ください。

言語

15言語のネイティブ台詞

以下の各シリーズはすべて同じパイプラインで制作されており、キャストはその言語をネイティブに話します。インターフェース、作業ドキュメント、話される台詞はすべて同じ言語で統一されており、吹き替えは一切使用していません。開いて実際に聞いてみてください。

全15言語を見る

よくある質問

なぜすべてのショットで衣装を記述しないのですか?

衣装を記述し直すと、モデルの注意が顔から逸れ、服を見せるためにカメラが後ろに下がり、頭が小さくなってキャラクターが認識できなくなるからです。衣装は設定画で一度定義すれば、そのキャラクターが登場するすべてのショットに自動で引き継がれます。

衣装の2枚目の画像が必要になるのはどのような場合ですか?

衣装そのものが変わる場合——完全な着替え、鎧、制服、焼けたり破れたりして元の形がわからなくなった場合などです。同じ衣装が濡れている、埃をかぶっている、血がついている、ボタンが外れているだけなら、ショットのテキストにその旨を書いてください。リファレンス条件付きモデルは、そうした表現を画像に重ねるエフェクトとして受け入れます。

脚本で季節の変化に合わせてキャラクターの衣装が変わる設定です。どうなりますか?

描写は画像生成前に分割されます。最初の衣装はベースシートに残り、後の衣装はそれぞれ専用の状態画像になります。これらをまとめて渡すと、1回のレンダリングでそれぞれの衣装のパーツを着た人物が描かれてしまいます。

各ショットではどの画像が使われますか?

そのセグメントに指定された状態が最優先で、次にエピソード単位の上書き設定、次にエピソードに割り当てられた状態、最後にベースシートが使われます。レンダリング済み画像のない状態は無効です——その場合ショットはベースシートを使用し、差分をテキストで記述します。

レンダリング済みのショットで衣装を変更できますか?

いいえ。衣装はショット生成時に確定するため、変更するには通常の秒単位の料金でそのセグメントを再生成する必要があります。

キャストの衣装は一度で設定

無料のリファレンス画像15枚で、小規模なキャスト全員分をまかなえます。

SceneMixerを無料で試す

クレジットパッケージは$1.49から · Proは$7.99/月 · 開始時にクレジットカードは不要

料金プラン·ガイド·サンプル·サポート·プライバシーポリシー·利用規約·法的情報·お問い合わせ·© 2026 SceneMixer