AIショットデザインの現在地:何が変わり、何が変わらないのか
ショットデザインとは、ひとつのカットに何をどう写すかを決める設計作業です。カメラの位置と高さ、レンズの画角、被写体の動き、照明の方向、構図のバランス、カットの長さ、そして前後のカットとのつながり。これらを物語の意図に沿って組み立てる工程は、長らく経験と勘、そして膨大な試行錯誤に支えられてきました。
生成AIがこの工程に持ち込んだ最大の変化は、試行一回あたりのコストの崩壊です。かつてはロケハン、照明機材の準備、俳優のスケジュール調整が必要だった検証が、テキストと参照画像だけで数分で回せるようになりました。絵コンテを描き、アニマティクスを作り、撮影し、編集するという直列的な工程が、部分的に並列化されたのです。
一方で、変わっていないものもあります。どのカットで観客に何を感じてほしいのか、どのタイミングで情報を開示するのか、どこでリズムを落として溜めを作るのか。こうした物語上の意思決定は、依然として人間の仕事です。AIは選択肢を高速に提示しますが、選ぶのは作り手です。この前提を忘れると、映像は「生成物の寄せ集め」になり、どれだけ画が美しくても物語として機能しません。
ショットデザインを3つの層に分けて考える
AIを使った制作を整理するには、作業を次の3層に分けると見通しがよくなります。
- 意図の層:このカットで観客に何を伝えるか。情報なのか、感情なのか、転換点なのか。
- 設計の層:意図を満たすカメラワーク、構図、尺、音の設計。ショットリストと絵コンテがここに属します。
- 生成の層:実際に映像を出力する工程。プロンプト、参照画像、シード値、モデル選択がここに入ります。
多くの失敗は、生成の層だけをいじって解決しようとするところから生まれます。顔が安定しない、カメラが意図しない方向に動く、カット間で光が変わるとき、本当の原因は設計の層にあることが少なくありません。
ワークフローはどこが短縮されるのか
短縮効果が大きいのは、以下の3工程です。第一に、構図のバリエーション出し。同じシーンを広角・望遠・俯瞰・ローアングルで即座に比較できます。第二に、色と光のトーン確認。夕景のオレンジ、曇天のフラットな光、夜のネオンを、撮影前に映像として確認できます。第三に、つなぎの検証。カットAからカットBへの動きの連続性を、編集前にチェックできます。
逆に短縮されにくいのは、台本の構造そのものの検討と、最終的な編集判断です。ここをAIに丸投げすると、テンポの悪い作品になります。
生成モデルの基礎理解:プロンプトがどこまで効くのか
映像生成モデルは大きく分けて、拡散モデル系のアプローチと、時系列を扱うアーキテクチャを組み合わせたものが主流です。重要なのは、モデルごとに「テキスト指示への忠実度」と「時間方向の安定性」のバランスが違うという点です。
カメラ指示語はどこまで通じるか
現行のモデルは、次のようなカメラ用語をかなり理解します。
- ドリーイン、ドリーアウト(前進・後退)
- パン、チルト(横振り・縦振り)
- クレーンアップ、クレーンダウン
- ハンドヘルド、ステディカム
- ズームイン、ズームアウト
- オービット(被写体の周囲を回る)
ただし、これらを複数同時に指定すると、どれかが無視されたり、不自然に混ざったりします。1ショットにつき主要なカメラモーションは1つに絞るのが原則です。どうしても2つ必要なら、ショットを分割するか、前後のカットで分担させます。
また「ゆっくり」「わずかに」といった速度の副詞は効きが不安定です。速度を制御したい場合は、フレーム数と移動距離を数値で示すか、始点と終点の画像を与えるほうが確実です。
プロンプトの基本構造
迷ったときは次の順序で書くと安定します。
- 被写体:誰が、何が、どんな状態で
- 動作:何をしているか、動作の途中か完了後か
- 環境:場所、時間帯、天候、周囲の要素
- 光:光源の方向、硬さ、色温度
- カメラ:位置、レンズ感、モーション
- スタイル:ジャンル、質感、フィルムかデジタルか
たとえば「雨の路地で傘を差した女性が立ち止まる。ネオンの反射が濡れた路面に伸びる。逆光気味の硬い光。 waist-high のミディアムショット、ゆっくりとしたドリーイン、35mm 相当、浅い被写界深度。フィルムグレインのあるシネマティックな質感」といった具合です。
モデルのクセを把握する
実写寄りの写実表現が得意なモデル、アニメ調の線と動きが得意なモデル、3Dレンダリング風の質感を出すモデルでは、同じプロンプトでも結果がまったく変わります。プロジェクトを始める前に、同じプロンプトを複数モデルで試す比較テストを10分だけ行うと、その後の工程が格段に楽になります。
比較するときの観点は次の4つです。
- 人物の顔と手の破綻率
- カメラモーションの指示追従性
- 色と光の再現度
- 指定尺での破綻の有無(終盤に崩れないか)
キャラクターとスタイルの一貫性を設計する
シリーズ物や複数カットにまたがる物語では、キャラクターの見た目がぶれると観客の没入が切れます。これはAI生成で最も多く報告される課題であり、同時に最も設計で解決しやすい問題です。
キャラクターシートを作る
まず、主人公の正面・斜め45度・横顔・背面の4方向を固定します。加えて、表情のバリエーションを3種類、全身のシルエットを1枚。これらを参照画像として保存し、全ショットで使い回します。
テキスト側にも固定記述リストを用意します。髪の色と長さ、瞳の色、肌のトーン、衣装の素材と色、アクセサリーの有無。これをプロンプトの冒頭に毎回コピーするだけで、ぶれが大幅に減ります。
参照画像とマルチイメージの使い分け
参照画像の与え方にはいくつかの方式があります。
- 単一参照:顔だけを固定したいときに使う。衣装は変えられる。
- 複数参照:顔と衣装と背景をそれぞれ別画像から取り込む。制御は強いが、情報が衝突しやすい。
- スタイル参照のみ:色調や描写の質感だけを借りる。キャラクターはテキストで指定する。
複数参照を使うときは、どの画像が何を担うのかを明確にし、互いに矛盾する要素を入れないことが重要です。顔の参照に金髪、テキストに黒髪と書けば、結果はどちらかになるか混ざります。
スタイルガイドを数値と単語で持つ
作品全体のトーンを固定するには、次の項目を文章として書き出しておきます。
- 色温度の方針(暖色寄り/寒色寄り/中間)
- コントラストの強さ
- フィルムグレインの有無と強さ
- レンズ感(広角の歪みを活かすか、望遠で圧縮するか)
- 被写界深度の傾向
- 動きの滑らかさ(24fpsの残像感か、シャープなデジタルか)
このガイドをプロンプトの末尾に毎回付けることで、カット間のトーンが揃います。
プリプロダクション:AI時代のショットリストの作り方
AIがあっても、ショットリストを飛ばしてはいけません。むしろ重要度は上がります。生成は速いので、設計が曖昧なまま進めると、大量の使えない素材が生まれます。
ログラインからビートへ
まず物語を3行で書きます。次に、その3行を8から12のビートに分解します。ビートとは「観客の理解や感情が変わる単位」です。各ビートに対して、必要なショットを割り当てます。
各ショットに目的を書く
ショットリストの表には、次の列を用意します。
| 列 | 内容 |
|---|---|
| No. | 通し番号 |
| 目的 | 情報提示/感情強化/転換/つなぎ |
| 内容 | 誰が何をしているか |
| カメラ | 位置、画角、モーション |
| 尺 | 想定秒数 |
| プロンプト | 実際に投入するテキスト |
| 参照 | 使用する参照画像 |
| 状態 | 未着手/生成済み/採用 |
「目的」の列が最も重要です。目的が書かれていないショットは、編集時に必ず迷います。
尺の見積もりとカバレッジ
生成モデルは、指定できる尺に制約があることが一般的です。短いクリップをつないで長いシーンを作る場合、各クリップの終端で動きを止めないのがコツです。動きの途中で切ると、次のクリップとつなぎやすくなります。
また、同じシーンに対して複数の画角を用意する「カバレッジ」を意識してください。マスター(引き)、ミディアム、アップ、そして挿入カット(手元、小物、風景)。これがあるだけで編集の自由度が跳ね上がります。
カメラワークと空間的一貫性の実践テクニック
複数のカットをつないだとき、観客が「同じ空間にいる」と感じられるかどうかは、空間的一貫性にかかっています。
イマジナリーラインを守る
二人の人物を向かい合わせて会話させる場合、二人を結ぶ線をまたいでカメラを置くと、位置関係が反転して見えます。AI生成では、この軸がカットごとに勝手に反転しがちです。対策は次の通りです。
- 各ショットのプロンプトに、人物Aは画面左、人物Bは画面右と明記する
- 背景の特徴的な要素(窓、看板、階段)の位置を固定する
- 参照画像に構図のラフを入れる
空間アンカーを決める
シーンの背景に、動かない目印を1つ決めます。柱、照明、家具、山の稜線などです。全ショットでその目印が同じ側に来るように指示すると、観客の脳が空間を再構成しやすくなります。
モーションの種類と注意点
ドリーインは感情の高まり、ドリーアウトは解放や孤独、パンは情報の提示、オービットは関係性の確認に向いています。こうした意味と動きの対応表を自分なりに持っておくと、ショットリストの段階で無駄なカットが減ります。
生成時の注意点としては、モーションの速度が速すぎると被写体が崩れやすいこと、逆に遅すぎると静止画のように見えることが挙げられます。まず中間の速度で生成し、編集で速度を調整するのが安全です。
First-to-Last-Frame制御でショットをつなぐ
始点画像と終点画像を与えて、その間を生成させる手法は、ショット設計の自由度を大きく広げます。
何に向いているか
- マッチカット:前のカットの終わりと次のカットの始まりを視覚的に一致させる
- トランジション:手のひらから街並みへ、など物理的につながらない場面転換
- モーフィング:人物の表情が変化する過程、時間経過の表現
- ループ:始点と終点を同じにして反復可能な素材を作る
実践手順
- 前のショットの最終フレームを書き出す
- 次のショットの初期フレームを生成する
- 両方の構図、光、色温度を揃える
- 中間の動きをテキストで補足する
- 生成結果のつなぎ目を確認し、ズレがあれば参照画像を修正する
この工程を踏むと、カット間のジャンプが大幅に減ります。特に人物が歩いてフレームアウトし、別の場所でフレームインするような場面では効果が絶大です。
スタイル操作と「意図的なズレ」の活用法
生成AIの出力は、しばしば「きれいすぎる」という問題を抱えます。完璧な肌、均一な光、整いすぎた構図。これを崩す技術が、作品の質を左右します。
質感を足す
- フィルムグレイン、ハレーション、軽い色収差
- 手ぶれ、ピントの浅さ、わずかな露出変動
- レンズフレア、ゴースト、周辺減光
これらは編集ソフトでも後から足せますが、生成時点で指定したほうが自然になじみます。
ジャンル別のスタイル辞書
- ドキュメンタリー風:自然光、 handheld、彩度控えめ、被写体がカメラを意識しない
- ホラー:低照度、長い静止、フレーム端の余白、ゆっくりしたズーム
- アクション:短いカット、動きのブレ、低いアングル、速いパン
- 日常系アニメ:柔らかい光、パステル、背景の描き込み、静止の間
自分が作るジャンルの辞書を10項目だけ書き出しておくと、判断が速くなります。
失敗を味に変える
生成の破綻は、必ずしも捨てるべきものではありません。顔の輪郭がわずかに溶ける、背景が不自然に反復する、動きが一瞬止まる。こうした現象は、夢の中のシーンや記憶のフラッシュバック、ホラー表現として使えます。「壊れたから作り直す」の前に、演出として使えないかを一度考える習慣をつけてください。
ワークフロー実例:30秒の短編を組み立てる
ここでは、30秒の短編を1日で仕上げる想定で工程を整理します。
午前:設計
- ログラインを3行で書く(15分)
- ビートを8つに分解する(20分)
- ショットリストを作る(40分)
- キャラクターシートを生成する(40分)
- スタイルガイドを書く(15分)
午後:生成と編集
- 各ショットを2から4バリエーション生成する(3時間)
- 使えるテイクを選び、つなぎを確認する(40分)
- 尺と速度を調整し、不要なフレームを切る(40分)
- 音を載せる。環境音、効果音、必要なら音楽(40分)
- カラーとグレインを統一し、書き出す(30分)
各段階のチェックポイント
- 設計段階:すべてのショットに目的が書かれているか
- 生成段階:同じキャラクターに見えるか、光の方向が揃っているか
- 編集段階:最初の3秒で引き込めるか、中盤で情報が過剰になっていないか
- 仕上げ段階:音を消しても物語が追えるか
音を消して確認するテストは特に有効です。映像だけで伝わらないなら、それはショット設計の問題です。
よくある失敗とトラブルシューティング
顔が毎カット変わる
原因は参照画像の不足か、テキスト記述の矛盾です。キャラクターシートを再確認し、固定記述リストをプロンプト冒頭に統一してください。また、カットごとに画角が大きく違うと顔がぶれやすいので、アップと引きを交互に並べすぎないことも有効です。
手や指が崩れる
手は現行モデルでも最も破綻しやすい部位です。対策は、手を画面の主要素にしないこと。手元を見せる必要があるなら、短いカットに分けるか、影や小物で隠す、あるいはアップを避けてミディアムで処理します。
カメラが勝手に動く
モーション指定が複数混在しているか、動きを示す単語が多すぎるのが原因です。カメラ指示を1つに絞り、速度の副詞を削り、必要なら静止を明示します。
カット間で光が変わる
シーン全体の時間帯と光源方向を、ショットリストの共通欄に書いてください。たとえば「夕方、窓は画面左、逆光」と決めれば、全カットでそれが守られます。
尺が足りない
モデルの上限を超える長さが必要な場合は、クリップを分割してつなぎます。このとき、前のクリップの終端で動きを完結させず、次のクリップの冒頭で同じ動きを継続させると、つなぎ目が目立ちません。
ツール選定の判断基準とFAQ
選定の判断軸
ツールを選ぶときは、次の順で確認すると失敗が少なくなります。
- 一貫性の制御手段:参照画像、キャラクター固定、シード固定ができるか
- 尺と解像度:必要な長さと画質に対応しているか
- カメラ制御:モーション指定の精度はどの程度か
- 編集連携:書き出し形式が編集ソフトと相性がよいか
- 共同作業:チームで素材を共有しやすいか
- 学習コスト:操作に慣れるまでの時間は許容範囲か
価格だけで選ぶと、後工程で時間を失います。逆に多機能すぎるツールは、使いこなせないまま放置されがちです。まず1本の短い作品を完成させることを基準に選んでください。
よくある質問
Q. 絵が描けなくてもショットデザインはできますか。
できます。ただし、構図の意図を言語化する力は必要です。ラフでもよいので、簡単な図を描いて参照画像にするほうが結果は安定します。
Q. AIで作った映像は、そのまま公開できますか。
利用するツールの規約と、使用した素材の権利を確認してください。公開前に、使用モデルと生成条件を記録として残しておくと安心です。
Q. 生成がうまくいかないとき、まず何を見直すべきですか。
プロンプトの長さです。要素を詰め込みすぎると、モデルは優先順位を失います。被写体と動作だけに絞って一度生成し、そこから光とカメラを足していくほうが、結果的に速く目的に到達します。
Q. カット数はどのくらいが目安ですか。
30秒の作品なら15から25カットが目安です。ただしジャンルによります。アクションは多く、静かなドラマは少なくなります。
Q. 音はどうしていますか。
環境音を先に敷き、そのリズムに合わせてカットの長さを微調整すると、映像がぐっと自然になります。
Q. チームで作るときに最初に決めるべきことは。
スタイルガイドとキャラクターシートです。この2つが共有されていれば、複数人が同時に生成してもトーンが揃います。
最後に:設計が9割
AIショットデザインの成否は、生成の技術よりも設計の質で決まります。どのカットで何を伝えるのかを明確にし、キャラクターとスタイルの基準を先に固め、カメラワークを意味と結びつけて選ぶ。この3つを守れば、生成モデルが変わっても、ツールが入れ替わっても、あなたの作品の質は安定します。技術は毎月のように更新されますが、物語の組み立て方は変わりません。だからこそ、ショットリストを丁寧に書く時間を惜しまないでください。

