SceneMixer
日本語
無料登録

AIキャラクター設定画ジェネレーター

AIキャラクター設定画ジェネレーター

2026年9月20日更新

簡単に説明すると: SceneMixerは各キャラクターを全身のリファレンスシートとして1回だけ生成します。9:16、無地の背景、指向性のあるキーライト、技術的な指示よりも先に記載されたキャラクターの特徴。その後、キャラクターが登場するすべてのショットに、このシートの切り抜きを添付します。設定画は作品としてではなく、キャスティング写真として作成されます。シートに焼き込まれた要素は、それを使うすべてのシーンに引き継がれるからです。すべてのアカウントに15が無料で付与されます。
SceneMixerがエンドツーエンドで生成したAIショートドラマ『Starfall Command』の静止画(キャラクター7人、1話)
サンプル:『Starfall Command』 — 写実HD、1話、脚本からSceneMixerパイプラインでエンドツーエンド制作 · エピソードを見る

ポスターではなく、キャスティング写真

ここでのキャラクターシートの役割は1つだけです。後のすべてのショットが照合する基準となる画像になることです。つまりこれはリファレンス画像であり、リファレンス画像は作品とは異なる基準で評価されます。シートに焼き込まれた要素は、それを使うすべてのショットに引き継がれます。たとえばシートで劇的なサイドライトを当てると、昼間のシーンでもそのサイドライトが再現されてしまい、ショットが本来必要とする照明と衝突してしまいます。そのためシートはキャスティング写真と同じように撮影されます。全身、9:16、無地の背景、顔とシルエットが明確に読み取れ、注意を奪う余計なものが何もない状態です。

質の悪いシートを見てわかった3つの制約

シート用プロンプトの役割と、各ルールが防ごうとしている失敗
フラットではなく、指向性のある光「フラットで均一な照明、影なし」はプラスチックのような顔を作る典型的なレシピです。フラットな光は肌の質感を消してしまいます。シートではメイン光源にフィルライトとリムライトを加えて照らし、プロンプトでは鼻の下の影、頬骨の移り変わり、目のキャッチライトを指定します。
アイデンティティを優先、技術は後分析ステップでは、骨格、ほくろ、傷といった非常に具体的な顔の特徴を書き出します。これを長い技術的なプロンプトの途中に埋めてしまうと、画像モデルはそれを薄めて、ありふれた整った顔に戻してしまいます。順番は固定です:まずこの人物が誰であるか、次にそれらの特徴をスムージングで消さないよう指示し、その後に技術ブロック、最後にフレーミングを記述します。
服装よりも顔を優先プロンプトではこれが俳優のキャスティング写真であり、洋服カタログではないことを明記し、頭のサイズを犠牲にしてまでカメラを引き、衣装を見せることを禁止しています。同じ理由で、無表情の指示も削除しました。無表情はキャラクターを認識可能にする存在感そのものを消してしまうからです。

4つ目の制約は内容ではなく長さに関するものです。デフォルトの画像モデルはプロンプトを下に読み進めるほど、記述への注意が散漫になります。そのため最も重要なルールはアイデンティティブロックの直後に配置し、プロンプト全体はモデルが実際に読む範囲に収まる長さに保たれています。上部に長い文章を追加するのは無料ではありません。肌と照明のルールがモデルの読み範囲から押し出されてしまうからです。

シートを作る対象、作らない対象

記述がそのままシートになる

シートは台本分析が出力したキャラクター記述から生成されます。つまり、顔を修正する最も安価なタイミングは、画像がまだ存在しない段階です。記述を読み、修正してから生成してください。2つの習慣が費用対効果を発揮します。結果ではなく原因を記述すること——「ハンサム」ではなく顎の形を書く——そして、傷、イヤリング、白髪の筋など、他と混同しようのない視覚的な目印を各キャラクターに1つ与えることです。同じ原則がパイプライン全体に通じており、キャラクターの一貫性ページで説明しています。

分析結果から結果ベースの表現(原因ではなく仕上がりを記述するメイクの言い回しなど)がどうしても紛れ込むことがありますが、画像モデルに渡る前に書き換えられます。結果だけを渡された画像モデルは、それを文字通り色の斑点として描いてしまう傾向があるからです。

今でも間違える点

料金と速度

シートは台本分析とは別に画像として課金されます。すべてのアカウントには、キャラクター、シーン、小道具を問わず、あらゆるプロジェクトで使えるリファレンス画像が15枚無料で付与されます。それを超えた分は、デフォルトの画像モデルで1枚あたり7クレジットです。シートの再生成にも初回と同じ料金がかかります。生成は高速です。2026年9月20日までの30日間にscenemixer.comで正常に生成されたすべての画像の計測では、リファレンス画像の生成時間の中央値は約16秒、10枚中9枚は27秒以内に完了します。そのため、一般的な5人のキャストであれば数分で完了し、無料枠で最初のキャスト分を十分にカバーできます。その他の詳細は料金ページをご覧ください。

1つのキャスト、15の言語

設定画は言語に依存しません。あくまで画像だからです。セリフの言語が変わると変わるのはキャスティング指示書です。別の市場向けのシリーズは、吹き替えで対応するのではなく、その市場向けにキャストを組み直します。以下、言語ごとに完成したシリーズを1つずつ用意しています。

言語

15言語のネイティブ台詞

以下の各シリーズはすべて同じパイプラインで制作されており、キャストはその言語をネイティブに話します。インターフェース、作業ドキュメント、話される台詞はすべて同じ言語で統一されており、吹き替えは一切使用していません。開いて実際に聞いてみてください。

全15言語を見る

よくある質問

設定画には何アングル分の描写がありますか?

全身ポーズが1つと、そこから切り出した顔と体のクロップが各ショットに付属します。複数アングルを並べたターンアラウンドのグリッドではありません。理由は実務上のものです。後続のショットで必要になるのは、明るくはっきりと写った顔とシルエットの情報です。小さなパネルを並べたグリッドでは、ピクセルあたりのそうした情報量がむしろ減ってしまうからです。

自分で用意したキャラクターアートを使うことはできますか?

はい。生成された設定画の代わりに画像をアップロードすれば、パイプラインはそれをまったく同じように扱います。別の場所ですでにデザインしたキャラクターや、モデルでは出せなかったルックのキャラクターにはこの方法を使ってください。

動物やクリーチャーにも使えますか?

はい。また、それらは意図的に別の描き方をします。着ぐるみではなく、現実の解剖学に基づいた種ごとの描写になるのです。解析時にキャラクターを人間以外としてマークすると、プロンプト全体が切り替わります。人間の手は出ず、服も着ず、その種が元から持っているのでない限り直立姿勢にもなりません。

背景が無地なのはなぜですか?

ほかの背景だと情報が引き継がれてしまうからです。特定のロケーションで設定画を撮ると、その場所の光と色が後でキャラクターが登場するすべてのシーンに焼き込まれてしまいます。無地の背景とニュートラルな指向性ライティングによって、設定画をどこでも使えるようにしています。それこそが一度生成して使い回す目的だからです。

2人のキャラクターが同じ名前だとどうなりますか?

壊れたりはしません。ショットは名前ではなく識別子でアセットを参照するため、名前の重複やプロジェクト途中のリネームによって間違った設定画が黙って割り当てられることはありません。また、プロジェクト内ですでに使われている名前を新しいアセットに付けることもできないようになっています。

スクリプトなしで設定画を生成できますか?

設定画はプロジェクト内で、解析によって見つかったキャストをもとに生成されます。そのプロジェクトのショットで再利用するためだからです。手動でキャラクターを追加して説明を記述することはでき、これがスタンドアロンのジェネレーターに最も近い使い方になります。ただし、紐づくショットのない設定画はただの画像でしかありません。

一度キャストすれば、顔をキープ

アカウントごとに15枚の参照画像、カードは不要です。

SceneMixerを無料で試す

クレジットパッケージは$1.49から・Pro $7.99/月・開始時にクレジットカードは不要

料金プラン·ガイド·サンプル·サポート·プライバシーポリシー·利用規約·法的情報·お問い合わせ·© 2026 SceneMixer