Start Free Now
Limited Time Offer: Get 50% OFF Starter & Basic Yearly Plans 🎉

AIショットデザイン実践ガイド:一貫性とカメラワークで作る映像ストーリーテリング

Sep 27, 2026

AIショットデザインの現在地:何が変わり、何が変わらないのか

ショットデザインとは、ひとつのカットに何をどう写すかを決める設計作業です。カメラの位置と高さ、レンズの画角、被写体の動き、照明の方向、構図のバランス、カットの長さ、そして前後のカットとのつながり。これらを物語の意図に沿って組み立てる工程は、長らく経験と勘、そして膨大な試行錯誤に支えられてきました。

生成AIがこの工程に持ち込んだ最大の変化は、試行一回あたりのコストの崩壊です。かつてはロケハン、照明機材の準備、俳優のスケジュール調整が必要だった検証が、テキストと参照画像だけで数分で回せるようになりました。絵コンテを描き、アニマティクスを作り、撮影し、編集するという直列的な工程が、部分的に並列化されたのです。

一方で、変わっていないものもあります。どのカットで観客に何を感じてほしいのか、どのタイミングで情報を開示するのか、どこでリズムを落として溜めを作るのか。こうした物語上の意思決定は、依然として人間の仕事です。AIは選択肢を高速に提示しますが、選ぶのは作り手です。この前提を忘れると、映像は「生成物の寄せ集め」になり、どれだけ画が美しくても物語として機能しません。

ショットデザインを3つの層に分けて考える

AIを使った制作を整理するには、作業を次の3層に分けると見通しがよくなります。

  • 意図の層:このカットで観客に何を伝えるか。情報なのか、感情なのか、転換点なのか。
  • 設計の層:意図を満たすカメラワーク、構図、尺、音の設計。ショットリストと絵コンテがここに属します。
  • 生成の層:実際に映像を出力する工程。プロンプト、参照画像、シード値、モデル選択がここに入ります。

多くの失敗は、生成の層だけをいじって解決しようとするところから生まれます。顔が安定しない、カメラが意図しない方向に動く、カット間で光が変わるとき、本当の原因は設計の層にあることが少なくありません。

ワークフローはどこが短縮されるのか

短縮効果が大きいのは、以下の3工程です。第一に、構図のバリエーション出し。同じシーンを広角・望遠・俯瞰・ローアングルで即座に比較できます。第二に、色と光のトーン確認。夕景のオレンジ、曇天のフラットな光、夜のネオンを、撮影前に映像として確認できます。第三に、つなぎの検証。カットAからカットBへの動きの連続性を、編集前にチェックできます。

逆に短縮されにくいのは、台本の構造そのものの検討と、最終的な編集判断です。ここをAIに丸投げすると、テンポの悪い作品になります。

生成モデルの基礎理解:プロンプトがどこまで効くのか

映像生成モデルは大きく分けて、拡散モデル系のアプローチと、時系列を扱うアーキテクチャを組み合わせたものが主流です。重要なのは、モデルごとに「テキスト指示への忠実度」と「時間方向の安定性」のバランスが違うという点です。

カメラ指示語はどこまで通じるか

現行のモデルは、次のようなカメラ用語をかなり理解します。

  • ドリーイン、ドリーアウト(前進・後退)
  • パン、チルト(横振り・縦振り)
  • クレーンアップ、クレーンダウン
  • ハンドヘルド、ステディカム
  • ズームイン、ズームアウト
  • オービット(被写体の周囲を回る)

ただし、これらを複数同時に指定すると、どれかが無視されたり、不自然に混ざったりします。1ショットにつき主要なカメラモーションは1つに絞るのが原則です。どうしても2つ必要なら、ショットを分割するか、前後のカットで分担させます。

また「ゆっくり」「わずかに」といった速度の副詞は効きが不安定です。速度を制御したい場合は、フレーム数と移動距離を数値で示すか、始点と終点の画像を与えるほうが確実です。

プロンプトの基本構造

迷ったときは次の順序で書くと安定します。

  1. 被写体:誰が、何が、どんな状態で
  2. 動作:何をしているか、動作の途中か完了後か
  3. 環境:場所、時間帯、天候、周囲の要素
  4. 光:光源の方向、硬さ、色温度
  5. カメラ:位置、レンズ感、モーション
  6. スタイル:ジャンル、質感、フィルムかデジタルか

たとえば「雨の路地で傘を差した女性が立ち止まる。ネオンの反射が濡れた路面に伸びる。逆光気味の硬い光。 waist-high のミディアムショット、ゆっくりとしたドリーイン、35mm 相当、浅い被写界深度。フィルムグレインのあるシネマティックな質感」といった具合です。

モデルのクセを把握する

実写寄りの写実表現が得意なモデル、アニメ調の線と動きが得意なモデル、3Dレンダリング風の質感を出すモデルでは、同じプロンプトでも結果がまったく変わります。プロジェクトを始める前に、同じプロンプトを複数モデルで試す比較テストを10分だけ行うと、その後の工程が格段に楽になります。

比較するときの観点は次の4つです。

  • 人物の顔と手の破綻率
  • カメラモーションの指示追従性
  • 色と光の再現度
  • 指定尺での破綻の有無(終盤に崩れないか)

キャラクターとスタイルの一貫性を設計する

シリーズ物や複数カットにまたがる物語では、キャラクターの見た目がぶれると観客の没入が切れます。これはAI生成で最も多く報告される課題であり、同時に最も設計で解決しやすい問題です。

キャラクターシートを作る

まず、主人公の正面・斜め45度・横顔・背面の4方向を固定します。加えて、表情のバリエーションを3種類、全身のシルエットを1枚。これらを参照画像として保存し、全ショットで使い回します。

テキスト側にも固定記述リストを用意します。髪の色と長さ、瞳の色、肌のトーン、衣装の素材と色、アクセサリーの有無。これをプロンプトの冒頭に毎回コピーするだけで、ぶれが大幅に減ります。

参照画像とマルチイメージの使い分け

参照画像の与え方にはいくつかの方式があります。

  • 単一参照:顔だけを固定したいときに使う。衣装は変えられる。
  • 複数参照:顔と衣装と背景をそれぞれ別画像から取り込む。制御は強いが、情報が衝突しやすい。
  • スタイル参照のみ:色調や描写の質感だけを借りる。キャラクターはテキストで指定する。

複数参照を使うときは、どの画像が何を担うのかを明確にし、互いに矛盾する要素を入れないことが重要です。顔の参照に金髪、テキストに黒髪と書けば、結果はどちらかになるか混ざります。

スタイルガイドを数値と単語で持つ

作品全体のトーンを固定するには、次の項目を文章として書き出しておきます。

  • 色温度の方針(暖色寄り/寒色寄り/中間)
  • コントラストの強さ
  • フィルムグレインの有無と強さ
  • レンズ感(広角の歪みを活かすか、望遠で圧縮するか)
  • 被写界深度の傾向
  • 動きの滑らかさ(24fpsの残像感か、シャープなデジタルか)

このガイドをプロンプトの末尾に毎回付けることで、カット間のトーンが揃います。

プリプロダクション:AI時代のショットリストの作り方

AIがあっても、ショットリストを飛ばしてはいけません。むしろ重要度は上がります。生成は速いので、設計が曖昧なまま進めると、大量の使えない素材が生まれます。

ログラインからビートへ

まず物語を3行で書きます。次に、その3行を8から12のビートに分解します。ビートとは「観客の理解や感情が変わる単位」です。各ビートに対して、必要なショットを割り当てます。

各ショットに目的を書く

ショットリストの表には、次の列を用意します。

列 内容
No. 通し番号
目的 情報提示/感情強化/転換/つなぎ
内容 誰が何をしているか
カメラ 位置、画角、モーション
尺 想定秒数
プロンプト 実際に投入するテキスト
参照 使用する参照画像
状態 未着手/生成済み/採用

「目的」の列が最も重要です。目的が書かれていないショットは、編集時に必ず迷います。

尺の見積もりとカバレッジ

生成モデルは、指定できる尺に制約があることが一般的です。短いクリップをつないで長いシーンを作る場合、各クリップの終端で動きを止めないのがコツです。動きの途中で切ると、次のクリップとつなぎやすくなります。

また、同じシーンに対して複数の画角を用意する「カバレッジ」を意識してください。マスター(引き)、ミディアム、アップ、そして挿入カット(手元、小物、風景)。これがあるだけで編集の自由度が跳ね上がります。

カメラワークと空間的一貫性の実践テクニック

複数のカットをつないだとき、観客が「同じ空間にいる」と感じられるかどうかは、空間的一貫性にかかっています。

イマジナリーラインを守る

二人の人物を向かい合わせて会話させる場合、二人を結ぶ線をまたいでカメラを置くと、位置関係が反転して見えます。AI生成では、この軸がカットごとに勝手に反転しがちです。対策は次の通りです。

  • 各ショットのプロンプトに、人物Aは画面左、人物Bは画面右と明記する
  • 背景の特徴的な要素(窓、看板、階段)の位置を固定する
  • 参照画像に構図のラフを入れる

空間アンカーを決める

シーンの背景に、動かない目印を1つ決めます。柱、照明、家具、山の稜線などです。全ショットでその目印が同じ側に来るように指示すると、観客の脳が空間を再構成しやすくなります。

モーションの種類と注意点

ドリーインは感情の高まり、ドリーアウトは解放や孤独、パンは情報の提示、オービットは関係性の確認に向いています。こうした意味と動きの対応表を自分なりに持っておくと、ショットリストの段階で無駄なカットが減ります。

生成時の注意点としては、モーションの速度が速すぎると被写体が崩れやすいこと、逆に遅すぎると静止画のように見えることが挙げられます。まず中間の速度で生成し、編集で速度を調整するのが安全です。

First-to-Last-Frame制御でショットをつなぐ

始点画像と終点画像を与えて、その間を生成させる手法は、ショット設計の自由度を大きく広げます。

何に向いているか

  • マッチカット:前のカットの終わりと次のカットの始まりを視覚的に一致させる
  • トランジション:手のひらから街並みへ、など物理的につながらない場面転換
  • モーフィング:人物の表情が変化する過程、時間経過の表現
  • ループ:始点と終点を同じにして反復可能な素材を作る

実践手順

  1. 前のショットの最終フレームを書き出す
  2. 次のショットの初期フレームを生成する
  3. 両方の構図、光、色温度を揃える
  4. 中間の動きをテキストで補足する
  5. 生成結果のつなぎ目を確認し、ズレがあれば参照画像を修正する

この工程を踏むと、カット間のジャンプが大幅に減ります。特に人物が歩いてフレームアウトし、別の場所でフレームインするような場面では効果が絶大です。

スタイル操作と「意図的なズレ」の活用法

生成AIの出力は、しばしば「きれいすぎる」という問題を抱えます。完璧な肌、均一な光、整いすぎた構図。これを崩す技術が、作品の質を左右します。

質感を足す

  • フィルムグレイン、ハレーション、軽い色収差
  • 手ぶれ、ピントの浅さ、わずかな露出変動
  • レンズフレア、ゴースト、周辺減光

これらは編集ソフトでも後から足せますが、生成時点で指定したほうが自然になじみます。

ジャンル別のスタイル辞書

  • ドキュメンタリー風:自然光、 handheld、彩度控えめ、被写体がカメラを意識しない
  • ホラー:低照度、長い静止、フレーム端の余白、ゆっくりしたズーム
  • アクション:短いカット、動きのブレ、低いアングル、速いパン
  • 日常系アニメ:柔らかい光、パステル、背景の描き込み、静止の間

自分が作るジャンルの辞書を10項目だけ書き出しておくと、判断が速くなります。

失敗を味に変える

生成の破綻は、必ずしも捨てるべきものではありません。顔の輪郭がわずかに溶ける、背景が不自然に反復する、動きが一瞬止まる。こうした現象は、夢の中のシーンや記憶のフラッシュバック、ホラー表現として使えます。「壊れたから作り直す」の前に、演出として使えないかを一度考える習慣をつけてください。

ワークフロー実例:30秒の短編を組み立てる

ここでは、30秒の短編を1日で仕上げる想定で工程を整理します。

午前:設計

  1. ログラインを3行で書く(15分)
  2. ビートを8つに分解する(20分)
  3. ショットリストを作る(40分)
  4. キャラクターシートを生成する(40分)
  5. スタイルガイドを書く(15分)

午後:生成と編集

  1. 各ショットを2から4バリエーション生成する(3時間)
  2. 使えるテイクを選び、つなぎを確認する(40分)
  3. 尺と速度を調整し、不要なフレームを切る(40分)
  4. 音を載せる。環境音、効果音、必要なら音楽(40分)
  5. カラーとグレインを統一し、書き出す(30分)

各段階のチェックポイント

  • 設計段階:すべてのショットに目的が書かれているか
  • 生成段階:同じキャラクターに見えるか、光の方向が揃っているか
  • 編集段階:最初の3秒で引き込めるか、中盤で情報が過剰になっていないか
  • 仕上げ段階:音を消しても物語が追えるか

音を消して確認するテストは特に有効です。映像だけで伝わらないなら、それはショット設計の問題です。

よくある失敗とトラブルシューティング

顔が毎カット変わる

原因は参照画像の不足か、テキスト記述の矛盾です。キャラクターシートを再確認し、固定記述リストをプロンプト冒頭に統一してください。また、カットごとに画角が大きく違うと顔がぶれやすいので、アップと引きを交互に並べすぎないことも有効です。

手や指が崩れる

手は現行モデルでも最も破綻しやすい部位です。対策は、手を画面の主要素にしないこと。手元を見せる必要があるなら、短いカットに分けるか、影や小物で隠す、あるいはアップを避けてミディアムで処理します。

カメラが勝手に動く

モーション指定が複数混在しているか、動きを示す単語が多すぎるのが原因です。カメラ指示を1つに絞り、速度の副詞を削り、必要なら静止を明示します。

カット間で光が変わる

シーン全体の時間帯と光源方向を、ショットリストの共通欄に書いてください。たとえば「夕方、窓は画面左、逆光」と決めれば、全カットでそれが守られます。

尺が足りない

モデルの上限を超える長さが必要な場合は、クリップを分割してつなぎます。このとき、前のクリップの終端で動きを完結させず、次のクリップの冒頭で同じ動きを継続させると、つなぎ目が目立ちません。

ツール選定の判断基準とFAQ

選定の判断軸

ツールを選ぶときは、次の順で確認すると失敗が少なくなります。

  1. 一貫性の制御手段:参照画像、キャラクター固定、シード固定ができるか
  2. 尺と解像度:必要な長さと画質に対応しているか
  3. カメラ制御:モーション指定の精度はどの程度か
  4. 編集連携:書き出し形式が編集ソフトと相性がよいか
  5. 共同作業:チームで素材を共有しやすいか
  6. 学習コスト:操作に慣れるまでの時間は許容範囲か

価格だけで選ぶと、後工程で時間を失います。逆に多機能すぎるツールは、使いこなせないまま放置されがちです。まず1本の短い作品を完成させることを基準に選んでください。

よくある質問

Q. 絵が描けなくてもショットデザインはできますか。
できます。ただし、構図の意図を言語化する力は必要です。ラフでもよいので、簡単な図を描いて参照画像にするほうが結果は安定します。

Q. AIで作った映像は、そのまま公開できますか。
利用するツールの規約と、使用した素材の権利を確認してください。公開前に、使用モデルと生成条件を記録として残しておくと安心です。

Q. 生成がうまくいかないとき、まず何を見直すべきですか。
プロンプトの長さです。要素を詰め込みすぎると、モデルは優先順位を失います。被写体と動作だけに絞って一度生成し、そこから光とカメラを足していくほうが、結果的に速く目的に到達します。

Q. カット数はどのくらいが目安ですか。
30秒の作品なら15から25カットが目安です。ただしジャンルによります。アクションは多く、静かなドラマは少なくなります。

Q. 音はどうしていますか。
環境音を先に敷き、そのリズムに合わせてカットの長さを微調整すると、映像がぐっと自然になります。

Q. チームで作るときに最初に決めるべきことは。
スタイルガイドとキャラクターシートです。この2つが共有されていれば、複数人が同時に生成してもトーンが揃います。

最後に:設計が9割

AIショットデザインの成否は、生成の技術よりも設計の質で決まります。どのカットで何を伝えるのかを明確にし、キャラクターとスタイルの基準を先に固め、カメラワークを意味と結びつけて選ぶ。この3つを守れば、生成モデルが変わっても、ツールが入れ替わっても、あなたの作品の質は安定します。技術は毎月のように更新されますが、物語の組み立て方は変わりません。だからこそ、ショットリストを丁寧に書く時間を惜しまないでください。

Alexander

Alexander