映画らしさを決めるのはモデルではなくショットデザイン
AI動画生成ツールが身近になり、テキストを入力すれば数秒のクリップが返ってくる時代になりました。しかし、生成されたクリップをただ並べただけでは、映画のような映像にはなりません。映画らしさを生み出しているのは、被写体そのものよりも「どの距離から、どの角度で、どれくらいの時間、どう動かして見せるか」という設計、つまりショットデザインです。
同じ「雨の交差点で人物が振り返る」という場面でも、ロングショットで人物を画面の隅に小さく置けば孤独や喪失が滲みます。逆に顔のクローズアップへゆっくりドリーインすれば、決意や緊張が前景化します。観客が受け取る感情は、演技やセリフだけでなく、フレームの選び方でかなりの部分が決まってしまうのです。生成モデルは「何を描くか」は得意ですが、「どう見せるか」を自律的に判断してくれるわけではありません。だからこそ、人間がショットデザインを設計し、AIへの指示として翻訳する工程が品質を左右します。
もう一つ見落とされがちなのは、ショットデザインが後戻りのコストを決めるという点です。カットの意図が曖昧なまま生成を繰り返すと、似たような映像が大量に生まれ、どれを採用すべきか判断できなくなります。逆に、ショットリストの段階でフレーミング・動き・尺を決めておけば、生成は「設計の検証」になり、試行回数を減らせます。AI映像制作の生産性は、生成速度ではなく、この設計の解像度で決まります。
シネマティックな表現を構成する5つの要素
映画的な映像は、感覚ではなく要素の組み合わせで作られます。AI生成に取り組む前に、以下の5つを語彙として持っておくと、プロンプトの精度が一段上がります。
ショットサイズとフレーミング
エクストリームロングショットは場所と状況を説明し、ロングショットは人物と環境の関係を示します。ミディアムショットは会話や動作の基準になり、クローズアップは感情を提示し、エクストリームクローズアップは細部で観客を引き込みます。重要なのは、これらをシーン内で「意図的に対比させる」ことです。ロングショットの直後にクローズアップを置けば、距離の変化そのものが心理的な圧力になります。AI生成では、同じ人物でも画角を変えると顔の再現性が揺らぎやすいため、対比を使いつつも基準となる画角を一つ決めておくのが安全です。
カメラの動き
固定、パン、ティルト、ドリー、トラック、クレーン、ハンドヘルド、ズーム、そしてドリーズーム。動きの種類よりも大切なのは「動きの理由」です。緊張を高めたいなら被写体へ寄る、孤立を強調したいなら引く、不安定さを出したいならハンドヘルド、というように感情と結びつけて選びます。AI生成では動きの指定が曖昧だと、モデルが独自の判断でカメラを動かし、意図と違う結果になりがちです。動きの種類・方向・速度・タイミングを短い言葉で明示する習慣をつけましょう。
レンズと被写界深度
広角レンズは空間を広く見せ、奥行きを強調します。望遠レンズは背景を圧縮し、人物を背景から分離します。ボケの量は視線の誘導に直結します。人物を際立たせたい場面で背景をクリアにしすぎると、観客の注意が分散します。逆に、状況を説明したい場面で背景を大きくぼかすと、場所の情報が伝わりません。「広角のロングショットで環境を見せ、望遠のクローズアップで感情に絞る」といったレンズの切り替えを設計に組み込みます。
ライティングとカラーパレット
光の方向は感情の方向です。逆光は輪郭を際立たせ、神秘性や希望を示します。サイドライトは陰影で人物の内面を強調します。正面からの柔らかい光は安心感を生みます。色温度も同様で、暖色は親密さ、寒色は距離や緊張を示します。AI生成では、シーンごとに光源の方向と色を文章で固定しないと、カットごとに太陽の位置が変わってしまいます。時間帯(朝・昼・夕方・夜)と光源の方向を必ず記述しましょう。
編集リズムとカットの尺
同じ素材でも、カットの長さで印象は変わります。短いカットを畳みかければ焦燥や高揚が生まれ、長回しに近いカットは沈黙や思考を表現します。AI生成は1クリップが数秒単位になりやすいため、あらかじめ「このシーンの平均カット尺は何秒か」を決めておくと、生成時の尺指定がぶれません。緊張のピークだけ短くし、前後を長く取るという緩急の設計が、素人っぽさを消す最短ルートです。
プリプロダクション:AI向けショットリストの設計
シーンをビートに分解する
ショットリストを作る第一歩は、シーンを「感情のビート」に分解することです。台本の1シーンを、登場人物の意図が変わる単位で3〜6個に区切ります。たとえば「待ち合わせに遅れる」というシーンなら、期待、不安、気づき、焦り、到着、というビートになります。ビートが決まれば、各ビートに必要なショットサイズと動きが自然に導き出せます。
感情曲線をカメラワークに翻訳する
次に、感情の強度を数値化してカメラの距離に対応させます。感情が弱いうちは引きの画、強まるにつれて寄りの画、という対応表を作ると判断が速くなります。すべてのカットをクローズアップにすると、感情の起伏が平坦になります。逆にすべて引きの画だと、観客は感情の変化に気づけません。緩急の設計とは、画角のグラデーションを設計することでもあります。
キーフレームとリファレンスボード
各ビートの代表的な1コマをキーフレームとして先に固めます。参考画像やムードボードを用意し、構図・光・色の方向性を視覚的に共有しておくと、テキストプロンプトの解釈のぶれが減ります。リファレンスは1枚に絞る必要はありませんが、シーンごとに2〜3枚程度に整理しておくと、生成結果のトーンが揃いやすくなります。
プロンプトでカメラワークと構図を制御する
構図を記述する基本順序
プロンプトは「被写体 → アクション → ショットサイズ → アングル → レンズ → 光 → 色 → 雰囲気」の順で書くと解釈が安定します。たとえば「雨に濡れた交差点で立ち止まる女性、ミディアムクローズアップ、やや見上げるアングル、85mm相当の望遠、街灯の逆光、寒色の夜、静かな緊張感」という形です。モデルによって得意な語順は異なるため、自分の環境で当たりが出た型をテンプレートとして保存しておくと再現性が高まります。
動きと時間を明示する
動きを指定するときは、種類・方向・速度・始点と終点をセットで書きます。「ゆっくりとしたドリーイン、被写体の顔に向かって、2秒かけて」のように時間を添えると、動きの量が安定します。逆に「カメラが動く」といった曖昧な表現は、意図しない揺れや回転を招きます。1カットにつき動きは1つに絞るのが原則です。複数の動きを同時に指示すると、どちらも中途半端になります。
一貫性のための記述ルール
一貫性を保つには、変化させてよい要素と固定すべき要素を分けます。人物の外見、衣装、髪型、照明の方向、色温度、背景の主要な構造は固定側です。一方、ショットサイズ、アングル、被写体の動作は変化側です。固定側の記述は毎回まったく同じ文言を使い、コピーして使い回すのが最も確実です。文章を言い換えると、モデルは別の人物や別の場所として解釈してしまいます。
避けたいNG記述
「映画のような」「高品質で」「美しい」といった抽象語だけを並べても、具体的なショットは返ってきません。これらは雰囲気の補助としては使えますが、構図や光の情報を代替しません。また、1つのプロンプトに複数のシーン展開を詰め込むと、どの要素も中途半端になります。カットは分割し、1カット1意図を守りましょう。
1カットを作る実践ワークフロー
ステップ1:意図を一文で書く
そのカットで観客に何を感じてほしいかを一文で書きます。「この人物が決断したことを伝える」といった具合です。この文が、後続のすべての判断の基準になります。
ステップ2:情報量を決める
観客に環境を見せるのか、感情を見せるのかを決めます。環境なら引きの画、感情なら寄りの画が基本になります。両方必要なら、2カットに分割するのが正解です。
ステップ3:ショットサイズとアングルを選ぶ
正面・斜め・俯瞰・あおりの中から、心理的な意味を意識して選びます。あおりは力強さや威圧、俯瞰は弱さや客観性を示します。
ステップ4:光と色を決める
光源の方向、時間帯、色温度、コントラストを指定します。ここを固定すると、複数カットをつないだときの連続性が保たれます。
ステップ5:プロンプトに翻訳する
前述の語順に沿って記述します。固定要素はテンプレートからコピーし、変化要素だけを書き換えます。
ステップ6:複数案を比較する
同じプロンプトで3〜5案を生成し、構図の安定性、顔の再現性、動きの自然さを比較します。良し悪しは好みではなく「意図が伝わるか」で判断します。
ステップ7:採用理由を記録する
採用したカットとその理由をメモします。「この画角と光で感情が伝わった」という記録が、次のシーンの判断を速くします。
シーン全体の一貫性を保つ方法
キャラクターの再現性
同じ人物を複数カットに登場させる場合、基準となるリファレンスを1つ決め、全カットで共通の記述を使います。服装、髪型、体格、年齢感、アクセサリーまで言語化しておくと、カット間の揺らぎが減ります。人物が画面に小さく映るカットでも、同じ記述を省略しないことが重要です。
照明と時間帯の連続性
同じシーン内では、時間帯を跨がない限り光源の方向と色温度を固定します。屋外なら太陽の位置、屋内なら窓の位置と照明器具の位置を、プロンプトの共通ブロックとして使い回します。ここを怠ると、カットごとに影の向きが反転し、視聴者に違和感を与えます。
色とトーンの統一
シーン全体のカラーパレットを2〜3色に絞り、全カットで共通して記述します。補色を一点だけ差し色に使うと、視線の誘導にも役立ちます。編集段階でカラー調整を揃える前提であっても、生成時点である程度揃えておくほうが後工程が軽くなります。
カメラ言語のルール化
「主観の場面ではハンドヘルド」「回想は固定で柔らかい光」「緊張の頂点は寄りでゆっくり」といったルールをあらかじめ決めておきます。ルールがあると、視聴者は無意識にシーンの意図を読み取れるようになります。逆にルールがないと、カットごとのスタイルがばらつき、映像全体が散漫に見えます。
よくある失敗と修正のしかた
カットごとに顔が変わる
原因は固定要素の記述が毎回変わっていることです。解決策は、人物記述をテンプレート化し、文言を一字一句同じにする運用に切り替えることです。あわせて、顔がはっきり見えるカットを基準として先に作り、それを参照しながら他のカットを生成すると揺らぎが減ります。
カメラの動きが速すぎる
AI生成は動きを誇張しがちです。速度を「ゆっくり」と明示し、動きの量を減らすか、動きのないカットに置き換えます。動きを消すことは失敗ではなく、編集でリズムを作るための有効な判断です。
すべてのカットが同じ画角
ミディアムショットばかりになると、映像が単調になります。ショットリストを見直し、引きと寄りを意図的に交互に配置します。目安として、シーンの最初と最後は距離を変えると印象が強くなります。
ライティングがカットごとに変わる
光源の方向と時間帯を共通ブロックとして固定し、全カットに貼り付けます。曇天や夜など、光の変化が少ない設定を選ぶのも有効な回避策です。
1カットが長すぎる
情報量に対して尺が長いと、観客の注意が切れます。1カットの目的を一つに絞り、目的が達成された時点でカットを終えるようにします。
テンポが単調
すべて同じ長さのカットが続くと、リズムが生まれません。短いカットと長いカットを意図的に混ぜ、感情のピークだけテンポを上げる設計にします。
ツール選定の判断基準
一貫性の扱いやすさ
同じ人物や場所を複数カットで維持できるかは最優先の比較軸です。参照画像を使えるか、共通の記述を保持できるか、カット間で崩れにくいかを、実際に短いテストシーンで検証します。
カメラワークの制御性
動きの種類や方向をどこまで指定できるか、指定が無視されにくいかを確認します。カメラ制御が弱いツールは、静的なカット中心の構成に向いています。
解像度と尺
最終的な納品先に必要な解像度と、1カットあたりの生成尺を確認します。尺が短いツールは、カット数を増やす編集設計と相性が良いです。
編集ソフトとの連携
書き出し形式、フレームレート、色情報の扱いを確認します。編集段階での手戻りを減らすには、生成時の設定を最初から揃えておくことが重要です。
料金体系の考え方
従量制か定額か、生成あたりの単価がいくらかを把握し、試行回数の見積もりと掛け合わせて判断します。単価が安くても、意図が出るまでに多くの試行が必要なら総コストは上がります。逆に単価が高くても、一発で意図に近い結果が出るなら効率的です。
短編1本を仕上げるロードマップ
準備段階
コンセプトを1文で定義し、登場人物と場所の共通記述を作ります。カラーパレットとライティングルールを決め、リファレンスを整理します。
設計段階
シーンをビートに分解し、各ビートにショットサイズ・アングル・動き・尺を割り当てます。ここでショットリストを表形式にまとめると、生成時の迷いがなくなります。
生成段階
カットごとに3〜5案を生成し、意図に合うものを採用します。採用したカットは命名規則を統一して保存し、後で探しやすくします。
編集段階
カットをつなぎ、テンポを確認します。不要なカットは容赦なく削り、感情の流れが途切れる箇所は尺を調整します。
仕上げ段階
色調整、音、効果音を加えます。音は感情の補強に効果が大きく、映像の粗さをかなりカバーできます。
よくある質問
AI生成だけで映画のような映像は作れますか
作れますが、条件があります。ショットデザインを人間が設計し、一貫性のルールを決め、編集でリズムを作る工程を省かないことが前提です。生成そのものよりも、前後の設計と編集に時間を配分すると結果が安定します。
ショットリストは何カットくらい必要ですか
1分の映像で10〜20カットが目安です。会話中心なら少なめ、アクション中心なら多めになります。まずは10カット程度の短い作品で、設計から編集までの流れを一通り体験するのがおすすめです。
プロンプトは英語のほうが良いですか
モデルによって得意な言語は異なります。重要なのは言語よりも構造です。被写体、動作、画角、レンズ、光、色の順で情報を並べ、固定要素と変化要素を分けて管理すれば、日本語でも十分に制御できます。
一貫性が崩れたときはどうすればよいですか
まず固定要素の記述が揺れていないかを確認します。次に、基準カットを決めてそこから派生させる運用に切り替えます。それでも崩れる場合は、人物が大きく映るカットを減らし、シルエットや後ろ姿など、詳細が見えにくい構図に逃がすのも実用的な解決策です。
初心者が最初に練習すべきことは何ですか
同じ人物・同じ場所で、画角だけを変えた5カットを作る練習です。これにより、一貫性の維持と画角の効果の両方を同時に学べます。次に、動きのあるカットを1つだけ加え、動きの制御を練習します。
生成したカットが意図と違うときは
いきなりプロンプトを全部書き換えるのではなく、変化させる要素を一度に一つに絞ります。画角だけ、光だけ、動きだけを変えて比較すると、どの記述が結果に効いているのかが把握できます。この切り分けが、再現性の高い自分専用テンプレートを作る近道です。
まとめ:設計が先、生成は後
映画のような映像は、高性能なモデルから自動的に生まれるものではありません。感情のビートを分解し、それぞれにふさわしい画角・動き・光を割り当て、固定要素を厳密に管理し、編集でリズムを整える。この一連の設計作業が、生成結果の質を決めます。
AIはショットデザインを代替する存在ではなく、設計を高速に検証するための道具です。まず1分の短編で、ビート分解からショットリスト、生成、編集までの流れを一通り回してみてください。カットごとの意図を言葉にできるようになったとき、同じツールから出てくる映像の説得力は明確に変わります。


