Start Free Now
Limited Time Offer: Get 50% OFF Starter & Basic Yearly Plans 🎉

AI動画でプロ級の映像を作るシネマトグラフィー設計:構図・照明・カメラワーク・レンズの基本

Oct 6, 2026

AI動画でシネマトグラフィーが品質を分ける理由

生成AIで動画を作れるようになり、「動く映像」そのものの価値は下がりました。今問われているのは、最初の数秒で視聴者の視線を捕まえ、感情を動かせるかどうかです。その差を生むのがシネマトグラフィー、つまりカメラワーク、フレーミング、ライティング、レンズの扱いといった撮影段階の設計です。

従来、これらは機材と経験の領域でした。クレーンやジンバル、大型照明、交換レンズをそろえ、撮影監督の判断で組み立てる必要があった。生成AIはこの前提を変えました。カメラの動きも、光の方向も、被写界深度も、テキストと参照画像で指示できる。ただし、AIが自動的に映画的な映像を出してくれるわけではありません。指示が曖昧なら、モデルは平均的な絵に落とし込みます。逆に撮影の語彙で具体的に指示すれば、同じモデルでも表現の密度は大きく変わります。

この記事では、AI動画制作をシネマトグラフィーの観点から組み立てる手順を、前工程から仕上げまで一通り扱います。特定のサービスに依存せず、どの生成モデルでも応用できる考え方に絞ります。

モデルは「指示の平均値」を返す

生成モデルは大量の映像から統計的な傾向を学んでいます。そのため情報が少ないプロンプトでは「よくある絵」に収束します。人物が中央に立ち、カメラは水平で、光は均一。初心者の生成結果が似たり寄ったりになるのは、モデルの性能ではなく、指示が平均的だからです。

平均から抜け出すには、平均的でない情報を与える必要があります。カメラの高さを下げる、光源を画面奥に置く、前景にぼけた要素を入れる。こうした一つの逸脱が、映像の印象を大きく変えます。

撮影語彙がプロンプトの解像度になる

「かっこよく」「映画っぽく」は、モデルにとって情報量がほぼゼロです。一方で「中望遠、浅い被写界深度、画面左からの柔らかいキーライト、ゆっくりしたドリーイン」は、具体的な設計図になります。撮影現場で使われる言葉をそのまま使うことが、出力の精度に直結します。

語彙を増やす最も効率的な方法は、好きな映画のワンシーンを一時停止し、構図、光の方向、レンズ感、カメラの位置を書き出すことです。書き出した言葉が、そのまま自分のプロンプトの部品になります。毎日1シーンずつ書き出す習慣をつけると、数週間で語彙の引き出しが大きく増えます。

撮影前の設計:ルック開発とショットリスト

シネマトグラフィーの質は、生成の前にほぼ決まります。最初にやるべきは、ルックの決定とショットリストの作成です。

ルック開発の手順

最初に決めるのは「どんな映画か」です。ジャンル、時代設定、カラーパレット、フィルムの質感、光の方向性を数行のメモにまとめます。同時に参照画像を3〜6枚用意し、共通する要素を言葉に落とし込みます。たとえば「曇天の拡散光」「青緑がかった影」「35mmフィルムの粒子」「彩度を抑えた中間色」といった具体化です。

ルックが曖昧なまま生成を始めると、カットごとに雰囲気がばらつき、後から統一する作業が膨大になります。最初の1時間をルック開発に使うだけで、後の作業時間は数時間単位で短縮できます。また、ルックを一行の文章として固定しておくと、プロンプトの冒頭に毎回貼り付けるだけでトーンを揃えられます。

ショットリストに書く項目

シーンをショットに分解し、各ショットに役割を持たせます。リストには次の項目を並べます。

  • 尺(秒数)
  • ショットサイズ(確立、ロング、ミディアム、クローズアップ)
  • カメラの動きと速度
  • レンズ感と被写界深度
  • 光源の方向と質
  • 時間帯と色温度
  • 前景に置く要素
  • 参照画像の指定

表形式にすると抜け漏れが減り、プロンプトの組み立てが機械的にできるようになります。特に「前景に置く要素」は忘れやすく、これがあるだけで映像の奥行きが変わります。

尺の設計

生成AIは短い尺のほうが安定します。1カット3〜8秒を目安にし、長いシーンは複数のショットをつないで作ります。特に動きの大きいショットは短く、静的なショットは長めに設定すると、リズムが生まれます。尺を先に決めておくと、編集時に足りないカットや余分なカットが明確になります。

カメラワークを指示語として組み立てる

AI動画で最も差がつくのがカメラワークです。「かっこよく動かして」では何も決まりません。撮影現場の語彙に置き換えましょう。

基本モーション語彙

  • 固定:三脚に固定した状態。緊張感や静けさに向く。
  • パン:水平方向の首振り。空間の広がりを示す。
  • ティルト:垂直方向の首振り。全身から空へ、など。
  • ドリー:前後の移動。被写体への心理的距離を変える。
  • トラッキング:被写体と並走する横移動。
  • クレーン:上下の大きな移動。場面の規模を強調する。
  • ハンドヘルド:手持ちの揺れ。ドキュメンタリー的な臨場感。
  • オービット:被写体の周囲を回り込む。英雄的な見せ方に有効。

これらを組み合わせ、速度も指定します。「ゆっくり」「一定速度で」「加速しながら」といった副詞が効きます。モデルは移動量の解釈が曖昧になりやすいため、開始位置と終了位置を言葉で示すのが確実です。たとえば「中景から始まり、被写体の目に向かってゆっくりドリーインし、最後はバストアップで止まる」と書きます。

動きの動機づけ

優れたカメラワークには動機があります。人物が振り向くからパンする、感情が高まるから寄る。AIに指示する場合も、動きの理由を一緒に書くと自然な結果になります。「彼が扉を開く瞬間に合わせて、わずかにティルトアップ」といった具合です。

また、すべてのショットを動かす必要はありません。静のショットを挟むことで、動のショットが際立ちます。全カットが動いている映像は、往々にして落ち着きがなく、疲れる印象になります。動と静の比率は、シーンの緊張感を調整するつまみだと考えてください。

方向の統一と180度ライン

同じシーン内ではカメラの移動方向を統一するのが基本です。右へ流れる映像の後に左へ流れる映像を置くと、視聴者は空間の向きを見失います。シーン全体の方針として「左から右へ流れる」と決めておくと、編集時の迷いがなくなります。

人物同士の会話では、二人を結ぶ線をまたいでカメラを反転させないよう意識します。いわゆる180度ラインです。AI生成では自動で反転してしまうことがあるため、プロンプトにカメラの位置関係を明記して防ぎます。

フレーミングと構図で視線を設計する

構図は、視聴者の視線をどこに導くかの設計です。AIに任せると中央配置の無難な絵になりがちなので、意図的に指定します。

アスペクト比を先に決める

縦型、横型、スクエアで構図の正解は変わります。縦型は上下の余白が広く、人物の立ち姿や奥行きの表現に向きます。横型は横方向の情報量が多く、風景や群衆の描写に強い。まず配信先を決め、その比率を前提にフレーミングを考えます。生成時に比率を指定できるモデルなら必ず指定し、後からのクロップで構図を壊さないようにします。

三分割とネガティブスペース

被写体を画面中央から少し外し、視線の先に余白を残すと、視線の方向が伝わります。余白は「これから何かが起きる」という予感も生みます。逆に、被写体を画面の端に寄せて手前側に空間を作ると、圧迫感や孤独感を演出できます。

前景・中景・背景のレイヤー

前景、中景、背景の3層を意識すると、映像に奥行きが出ます。前景にぼけた枝や手すりを置き、中景に人物、背景に遠景を配置する。AI生成では前景要素が抜け落ちやすいので、プロンプトに「手前にぼけた〜」と明示します。

視線誘導の実例として、喫茶店のシーンを考えます。窓から差し込む光を背景に置き、人物を画面左三分の一に配置。手前には湯気の立つカップをぼかして置く。これだけで、視線は人物の顔からカップへ、そして窓の光へと自然に流れます。

カメラの高さを変える

目線の高さだけで撮る必要はありません。見上げる構図は被写体を強く見せ、見下ろす構図は弱さや孤立を示します。地面すれすれの低い位置からのショットは、日常の風景を非日常に見せる力を持っています。カメラの高さは、感情の方向を決めるパラメータです。

ライティングとテクスチャで感情を作る

光は感情です。同じ構図でも、光の当て方ひとつで意味が変わります。

キーライトの方向

  • 正面光:フラットで穏やか。コメディや明るい会話劇に向く。
  • 斜め45度:立体感が出て、人物が生き生きとする。汎用性が高い。
  • サイド光:陰影が強く、ドラマチック。善悪や緊張を表現する。
  • 逆光:輪郭が光り、シルエットが際立つ。神秘性や希望に使える。
  • アンダーライト:不穏で不自然。ホラーや心理劇に有効。

指示では「画面左からの柔らかいキーライト」「背景に暖色の実用光源」のように、方向、硬さ、色温度をセットで書きます。光源を一つに絞ると、映像に統一感が出ます。

時間帯と色温度

ゴールデンアワーの暖色、ブルーアワーの寒色、真昼の硬い光、夜の人工光。時間帯を指定するだけで、映像のトーンは大きく変わります。色温度を数値で示せるなら、3200K(タングステン)、5600K(昼光)を基準にすると意図が伝わりやすくなります。

影をデザインする

光を語るとき、影は後回しにされがちですが、影が画面の緊張感を作ります。顔の半分を影に落とす、背景に格子状の影を落とす、逆光で人物のシルエットを作る。これらはすべて「影の形」を指定することで再現できます。影を消そうとするのではなく、形を設計する発想が重要です。

粒子とフィルムルック

デジタル生成映像は往々にして滑らかすぎます。フィルムグレイン、わずかなハレーション、レンズフレア、軽い色収差を加えると、写真としての説得力が増します。ただし加えすぎると安っぽくなるので、粒子は控えめに。仕上げの段階で調整するほうが失敗が少ないです。

レンズと被写界深度の扱い

レンズの選択は、視聴者と被写体の距離感を決めます。

焦点距離の使い分け

  • 広角(24mm前後):パースが強調され、空間の広がりや不安定さを演出する。
  • 標準(35〜50mm):人間の視覚に近く、自然な印象。
  • 中望遠(85mm前後):人物を美しく切り取り、背景を圧縮する。
  • 望遠(135mm以上):背景を大きくぼかし、被写体を際立たせる。

被写界深度とラックフォーカス

被写界深度は「浅い」「深い」で指示します。浅いと被写体が浮き上がり、深いと画面全体に情報が入ります。ポートレート的なショットは浅く、風景や群衆は深く。ボケの形状や背景の分離具合を指定できると、より映画的な質感に近づきます。

ピントの移動(ラックフォーカス)も強力な演出です。手前の人物から奥の人物へピントを移すだけで、視線と物語の焦点を同時に移動できます。

ショット間の一貫性を保つワークフロー

複数ショットをつなぐと、人物の顔、服装、光の方向がばらつきがちです。これを抑えるには、参照と記録の仕組みが必要です。

参照画像とキーフレーム

キャラクターの基準画像を用意し、各ショットで同じ参照を使います。画像から動画を生成できるモデルなら、開始フレームを固定するのが最も確実です。加えて、衣装、髪型、小物をテキストでも明記し、ショットごとに同じ記述を貼り付けます。

環境と光の固定

光の方向、時間帯、天候、背景の要素も同様に固定します。シーンAで「午後の逆光」と決めたら、シーンAの全カットで同じ記述を使います。カットごとに雰囲気を変えたくなっても、まずは統一し、変化は編集で意図的に入れるほうが安全です。

つなぎの処理とカラー統一

カット間のジャンプを避けるには、動きの方向をそろえます。左へ歩き始めた人物は、次のカットでも左へ進む。視線の方向も同様です。180度ラインを意識し、カメラが被写体をまたいで反転しないようにします。

生成後はカラー調整で全カットのトーンをそろえます。一つのルックを決め、全ショットに適用したうえで、露出だけ個別に微調整する。この工程があるだけで、別々に生成した映像が一つの作品に見えます。

プロンプト設計とモデル選定の判断基準

プロンプトの基本順序

指示の質は、情報の順序と網羅性で決まります。以下の型を用意しておくと、毎回同じ品質で書けます。

  1. ショットサイズ
  2. 被写体と動作
  3. 場所と時間帯
  4. カメラワークと速度
  5. レンズと被写界深度
  6. 光源の方向と質
  7. 色温度と全体の色調
  8. 質感(粒子、フレア、フィルム感)
  9. 構図上の指定(余白、前景、視線の向き)

この順序で書くと、モデルは情報を整理して解釈しやすくなります。逆に、思いついた順に書くと重要な要素が埋もれます。否定形はなるべく避け、「人物が動かないで」ではなく「人物は立ち止まり、静かに立っている」と肯定形で書きます。

モデルの得意分野と併用

AI動画のモデルは用途ごとに得意分野が異なります。判断基準を整理します。

  • リアルな人物:フォトリアル系の画像生成で素材を作り、画像から動画へ変換する流れが安定する。
  • 長回しの一貫性:時間的な安定性に強いモデルを選ぶ。
  • スタイライズド:アニメや絵画調は専用モデルが有利。
  • カメラ制御:モーション指定やレンズ指定ができるモデルを優先する。
  • 速度と試行回数:案を大量に出す工程は生成が速いモデル、決定稿は高品質モデル。

複数モデルの併用が現実的です。同じ指示文を2〜3のモデルに入れ、寄りの強いものを選ぶ。ハイブリッドな使い方が品質を押し上げます。

テストと比較の進め方

選定の際は、実際に自分の題材で3ショットだけテストするのが確実です。デモ映像の美しさと、自分の素材での再現性は別物だからです。テストでは一度に一つの要素だけを変え、カメラ、光、被写体のどれが効いたかを確認します。差分が分かると再現性が上がります。

よくある失敗と対処

動きが滑る、不自然に見える

原因は移動量の指定が大きすぎることです。1ショットあたりの移動を減らし、速度を明示します。開始位置と終了位置を書き、フレームレートやシャッターの表現を加えると自然さが増します。

顔がカットごとに変わる

参照画像を使い、衣装と髪型の記述を統一します。それでも揺れる場合は、寄りのショットを減らし、後ろ姿や手元など顔が出ないカットでつなぐ工夫も有効です。

光が合わない

光源の方向と色温度を各指示文に明記します。逆光と正面光を混在させると破綻しやすいので、シーン単位で統一します。時間帯の記述も忘れずに。

映像が平面的に見える

前景要素の不足が原因のことが多いです。手前のぼけ、大気の粒子、光の筋を加えると奥行きが出ます。カメラの高さを変えるのも効果的です。

手や小物が崩れる

手を使う動作は避け、カットを分けて見せるのが定石です。小物はシンプルな形状にし、動きの中で変形しないものを選びます。

尺が合わない

生成は短い尺のほうが安定します。長いショットが必要なら、複数の短いカットをつないで一続きに見せる編集で対応します。

全体的に安っぽく見える

多くの場合、原因は光と色の情報量不足です。光源を一つ追加し、色温度をそろえ、粒子をわずかに加える。この3点を試すだけで印象は大きく変わります。

実践:30秒シーンの組み立てとFAQ

30秒シーンのショット構成

具体例として、雨の街を歩く人物の30秒シーンを想定します。

  1. 確立ショット(5秒):広角、高い位置から。ネオンの反射した濡れた路面。ゆっくりパン。
  2. 人物の導入(4秒):中望遠、横から並走するトラッキング。傘を持ち、下を向いている。
  3. 心情(3秒):クローズアップ。顔に当たる看板の光。浅い被写界深度。
  4. インサート(2秒):足元の水たまりに落ちる雨粒。固定。
  5. 転換(5秒):人物が立ち止まり、顔を上げる。わずかにティルトアップ。
  6. クライマックス(6秒):正面からのゆっくりドリーイン。背景の光がぼける。
  7. 余韻(5秒):後ろ姿で遠ざかる。深い被写界深度で街全体を映す。

各ショットで、光の方向(ネオンは画面奥)、色温度(寒色寄り)、粒子の量を統一します。編集では環境音と低音を重ね、最後に無音を一瞬入れると余韻が強まります。この構成のポイントは、カメラが常に動いているわけではないことです。固定のインサートを挟むことで、動きのあるショットが強調されます。

FAQ

プロンプトに何を書けば映画的になりますか

カメラの動き、レンズの焦点距離、光の方向と硬さ、時間帯、フィルムの質感、構図の指定。この6点を毎回書くだけで印象が変わります。

モデルは一つに絞るべきですか

絞る必要はありません。用途ごとに得意分野が違うため、2〜3を使い分けるほうが結果が良くなります。ただし参照画像と記述のフォーマットは統一しましょう。

生成がうまくいかないときは

一度に多くの要素を変えず、カメラ、光、被写体のうち一つだけを変えて比較します。差分が分かると再現性が上がります。

縦型でも映画的に見せられますか

可能です。縦型は奥行き表現が苦手なので、前景と背景のレイヤーを意識し、上下の余白を活かした構図を作ります。人物の目線の先に空間を残すのがコツです。

音はどこまで作るべきですか

環境音、足音、衣擦れ、低音の4層を基本にすると、生成映像の粗さが目立ちにくくなります。無音の間も演出として使えます。

学習は何から始めればよいですか

好きな映画のワンシーンを止めて、構図、光、レンズを書き出す練習が最も効率的です。書き出した言葉がそのまま指示文の語彙になります。

表情が足りません

表情は顔のアップと短い尺の組み合わせで補います。長回しで感情を表現しようとすると破綻しやすいため、ショットを細かく分けるほうが結果が安定します。

同じキャラクターで複数話を作るには

キャラクターの基準画像、衣装の記述、光の設定をテンプレート化して保存します。毎回ゼロから書かず、テンプレートを複製して差分だけ書き換える運用が現実的です。

Alexander

Alexander