SceneMixer
日本語
無料登録

1枚の写真から広告を作る方法

簡単に言うと: 売りたいもの(商品、料理、車、店頭、アプリ画面など)の写真を1〜4枚アップロードするだけ。SceneMixerが写真を読み取って内容を把握し、短い台本を作成し、出演者やロケーションを生成し、各セグメントを撮影したうえで、ブランド名・商品名・タグライン・行動喚起を載せたエンドカードを付けて仕上げます。長さ・アスペクト比・解像度を選べば、あとはワンボタンですべて完了します。
SceneMixerがエンドツーエンドで生成したAIショートドラマ『Starfall Command』の静止画(キャラクター7人、1話)
サンプル:『Starfall Command』 — 写実HD、1話、脚本からSceneMixerパイプラインでエンドツーエンド制作 · エピソードを見る

広告の生成パイプラインはドラマのパイプラインと同じエンジンで動いているため、出力される絵コンテはこのサンプルプロジェクトで見られるものと同じ実用的なドキュメントです。

ステップ1 — 写真を追加する

同じ被写体の写真を最大4枚まで:異なるアングル、ディテールショット、使用中の様子など。1枚目はメインの被写体として扱われ、エンドカードの中心になるほか、商品・料理・衣類の場合は白背景のすっきりしたショットとして再描画されます。店舗・車・アプリ画面は再描画されません(後述)。残りの写真はロケーションとして使われます。

写真の読み取りは課金前に行われます。読み取り結果が不鮮明、認識できるものがない、アスペクト比がおかしいスクリーンショットなどで使えない場合は、その場で通知され、クレジットは消費されません。

ステップ2 — 写真がわかりにくい場合は、内容を記入する

アップロード欄の隣に1行入力ボックスがあります。写真だけでは誤解されそうなときに使ってください。「これはストックフォトではなく当店の店舗です」と書けば、演出全体が変わります。店舗は広告の舞台となる場所であるのに対し、商品は広告がその周りで展開される小道具だからです。

入力した文と写真の内容が矛盾する場合は、文が優先されます。モデルが見た内容よりも、あなたが入力した内容が優先される唯一の箇所です。

ステップ3 — 長さ、トーン、アスペクト比、解像度を選ぶ

長さは15秒、30秒、60秒から選べ、それぞれ15秒のセグメントが1本、2本、4本になります。トーンは展開のパターンを選ぶ項目で、スペクタクル、コメディ、温かみ、ミニマル、どんでん返し、食欲、デモ、ライフスタイルの8種類があり、それぞれ独自の構成と美術演出が適用されます。

解像度は480p、720p、1080pから選べます。各オプションに表示される料金には全工程が含まれているため、表示された金額がそのまま支払額になります。

ステップ4 — すべてAIに任せるか、自分で調整する

AIに任せると、写真のクリーンアップ、台本作成、構成分解、出演者とセットの生成、各セグメントの撮影、エンドカードとの合成まで、全工程を自動で実行し、最初に確定料金が表示されます。

ステップバイステップモードでは、前払い額が安く、台本作成後に通常のエディタが開きます。残りの工程に課金する前に、セリフを書き換えたり、キャラクターを変更したり、1つのセグメントだけ撮り直したりできます。

写真に対する処理とその理由

商品、食品、衣類は、すべてのセグメントで一貫した照明を当てられるよう、白背景のすっきりしたスタジオショットとして再描画されます。店舗、レストラン、車、家屋は再描画されません。周囲から切り抜くと、看板や奥行き、スケール感といった、それらを認識可能にしている要素が失われてしまうからです。アプリやウェブのスクリーンショットも再描画されません。再描画すると読み取り可能なUIが崩れてしまいます。

場所や乗り物の写真に人物が写っている場合は、他の処理の前にそれらを削除します。参照フレームを渡されたモデルはその中の顔を複製してしまうため、実在の通行人を広告に登場させることはしません。

コピーのルール

最上級表現や絶対的な主張(「どこよりも最安値」「売上No.1」「何でも治る」など)は、制作前に台本から除去されます。ブランド名や商品名も同様のチェックを受けますが、対象は明らかな主張を含むものに限られます。通常の商標はそのまま残りますが、「#1」「100%」「保証」など主張を含む名称は表現を和らげます。

各セグメントには少なくとも1つのセリフが入り、タグラインは最後のフリーズの前に読み上げられます。映像内に読み取り可能な文字は書き込まれません。動画生成モデルは読めるテキストを正確に描画できないため、正確に伝える必要のある言葉はナレーションとエンドカードで届けます。

設定内容
写真同じ被写体を1〜4枚。1枚目がメイン
長さ15秒 / 30秒 / 60秒 → セグメント1 / 2 / 4本
トーン8種類の展開パターン、それぞれ独自の美術演出付き
解像度480p / 720p / 1080p、オプションごとに料金表示
エンドカードブランド、商品、タグライン、行動喚起
音楽映像と一緒に生成、後付けはしない

よくある質問

台本は必要ですか?

不要です。台本は写真と1行の説明から自動で作成されます。ステップバイステップモードでは、撮影前に台本を書き換えられます。

商品ではなく自分の店の写真を使えますか?

はい。意図的に別の方法で処理されます。場所は広告の舞台となるロケーションになり、最初のシーンはテキストから想像されるのではなく、あなたの写真から再構築されます。

画面にロゴや価格は表示されますか?

エンドカードにのみ表示されます。動画生成モデルは読み取り可能なテキストを安定して描画できないため、正確に読ませる必要のあるものはすべて最後のカードに配置し、それ以外はナレーションで伝えます。

写真に顧客が写っていたらどうなりますか?

店舗、レストラン、乗り物の場合は撮影前に削除されます。人物が写っているスクリーンショットは編集されず、そのまま拒否されます。

完成後に広告を変更できますか?

エンドカードのテキストを変えて再合成できるほか、ステップバイステップモードでは個別のセグメントを撮り直せます。完成したファイルはダウンロードしたり、リンクで共有したりもできます。

1枚の写真で試してみましょう

写真の読み取りは無料です。広告全体の料金は開始前に表示されます。

広告を作る

2026年9月21日更新

料金プラン·ガイド·サンプル·サポート·プライバシーポリシー·利用規約·法的情報·お問い合わせ·© 2026 SceneMixer