AI動画生成の品質は、使うツールの性能だけで決まるわけではありません。同じモデル、同じ秒数、同じ解像度で生成しても、入力するテキストの構造と語順、具体性、制約条件によって結果は大きく変わります。プロンプト設計は、いわば映像制作における仕様書であり、絵コンテであり、演出指示です。感覚的な呪文ではなく、再現可能な設計図として扱うことで、思い通りの映像に近づけられます。
AI動画生成でプロンプト設計が重要な理由
AI動画生成モデルは、入力された単語の意味を学習データと確率に基づいて解釈します。人間のように意図を汲み取るわけではありません。そのため、主題、動作、環境、カメラ、照明、スタイル、制約を整理して伝える必要があります。曖昧な表現は曖昧な結果を生み、矛盾した指示は破綻した映像を生みます。
モデルは指示の解釈器である
モデルごとに学習データの偏り、得意な表現、苦手な動きがあります。リアリズムに強いモデル、アニメーションに強いモデル、短尺のSNS向けに強いモデル、長回しに強いモデルはそれぞれ異なります。プロンプト設計では、モデルの個性を前提に、語彙と構造を選びます。
出力品質は入力の構造に比例する
漫然とキーワードを並べるより、被写体、動作、場所、時間帯、カメラ、光、質感、除外要素の順に整理した方が安定します。特に動画では、時間軸の変化を指示する必要があるため、静止画以上に構造が重要です。
プロンプトの基本構造を分解する
AI動画のプロンプトは、大きく分けて主題、動作、環境、カメラ、照明、スタイル、ネガティブ指定の七つで構成できます。すべてを毎回書く必要はありませんが、迷ったときはこの順番で組み立てると整理しやすくなります。
主題・動作・環境
主題は誰か、何かを具体的にします。「女性」ではなく「三十代の女性、黒髪を後ろで束ね、紺のトレンチコート、右手に紙袋」のように書きます。動作は「歩く」ではなく「雨上がりの路面をゆっくり歩き、ときどき足元を見る」のようにします。環境は「東京の路地、夜、ネオン看板、濡れたアスファルト、遠くに自転車」などです。
カメラ・照明・レンズ
カメラ指示は映像の印象を大きく左右します。「三十五ミリレンズ、ミディアムショット、アイレベル、ゆっくりしたドリーイン」のように、焦点距離、ショットサイズ、アングル、モーションを指定します。照明は「夕暮れの逆光、ネオンの反射、柔らかいリムライト、浅い被写界深度」などです。
スタイルと質感
スタイルは「シネマティック」「ドキュメンタリー風」「アニメ調」「八ミリフィルム風」などです。質感は「粒子感、わずかな色収差、彩度控えめ、コントラスト強め」のように補足します。スタイル名だけでなく、色、光、素材感まで書くと再現性が上がります。
ネガティブ指定と重み付け
ネガティブ指定は、避けたい要素を明示する方法です。「低品質、ぼやけ、余分な指、歪んだ顔、文字化け、過剰なシャープ、プラスチックのような肌」などを必要に応じて加えます。重み付けはモデルによって記法が異なりますが、特定要素を強調しすぎると全体のバランスが崩れるため、まずは通常の語順で試し、必要な場合だけ調整します。
動画特有の課題:時間軸と一貫性
静止画と動画の最大の違いは、時間の流れです。フレーム間で被写体、背景、光、色がつながっていなければ、視聴者は違和感を覚えます。動画プロンプトでは、一貫性を保つための指示を意識的に入れます。
キャラクターの同一性
同じ人物を複数カットで登場させる場合は、特徴を毎回同じ言葉で書きます。髪型、服装、年齢、体型、持ち物、表情の癖を固定します。参照画像を使えるモデルなら、複数の参照を用意し、顔と服装を別々に指定すると安定しやすくなります。
背景とライティングの連続性
カットが変わっても同じ場所なら、時間帯、天候、光源の方向、看板の色を揃えます。「同じ路地、同じ夜、同じネオン、同じ濡れた路面」のように繰り返します。光源の向きが急に変わると、別の場所に見えてしまいます。
シーンの切り替え
カット割りを指示する場合は「カット一、クローズアップ、手の動き。カット二、ミディアムショット、振り返る。カット三、ロングショット、路地を歩き去る」のように番号を振ります。モデルによっては一つのクリップ内で複数カットを苦手とするため、必要ならクリップを分けて編集でつなぎます。
モデル別プロンプト戦略
AI動画モデルはそれぞれ得意分野が異なります。ここでは一般的な傾向を整理します。実際の挙動はバージョンや設定で変わるため、小さなテストを繰り返して確認してください。
リアリズム系モデル
リアリズム系は、光、質感、肌、素材の再現に強い一方で、曖昧な指示だと余計なディテールを補完します。具体的なレンズ、照明、時間帯を書き、ネガティブ指定でノイズや不自然な影を抑えます。動きは控えめにし、カメラモーションを明確にします。
アニメーション・スタイル系
アニメーションやイラスト調のモデルは、スタイル名、線の太さ、色数、背景の密度を指定すると安定します。「セル画調、太い輪郭線、限定色、劇場アニメの背景」のように書きます。キャラクターの同一性は参照画像と特徴記述の併用が効果的です。
短尺SNS・広告向け
短尺向けでは、最初の一秒で視線を引き、三秒から五秒で意味を伝え、最後に余韻を残す構成が基本です。プロンプトにも「冒頭で手元をクローズアップ、中央で商品を掲げる、最後にロゴスペースを空ける」のように時間配分を書きます。
カメラワークを言葉で設計する
カメラワークは、映像の感情を決める重要な要素です。プロンプトでカメラを指示するときは、ショットサイズ、アングル、モーション、レンズ、照明をセットで考えます。
ショットサイズとアングル
クローズアップは感情、ミディアムショットは関係性、ロングショットは環境を伝えます。アングルはアイレベルが自然、ローアングルが力強さ、ハイアングルが不安や小ささを演出します。これらを動作と組み合わせます。
モーション指示
パンは横移動、ティルトは縦移動、ドリーは前後移動、トラックは被写体と並走、ズームは画角変化です。手持ち風は臨場感、固定カメラは落ち着きを与えます。動画生成では動きが大きすぎると破綻しやすいため、速度を「ゆっくり」「わずかに」と指定します。
ライティングと色
キーライト、フィルライト、リムライトの位置を言葉にします。ゴールデンアワーは温かく柔らか、ブルーアワーは冷たく静か、ネオンは彩度が高く夜に映えます。カラーパレットを「ティールアンドオレンジ」「モノクロに赤だけ残す」のように指定すると統一感が出ます。
実践ワークフロー:企画から書き出しまで
プロンプト設計は一度で完成させません。企画、言語化、ラフ生成、選別、修正、書き出しのサイクルを回します。
目的と制約の言語化
最初に用途、尺、縦横比、解像度、トーン、必須要素、禁止要素を書き出します。SNS用の縦動画か、プレゼン用の横動画か、広告用かで設計は変わります。制約を先に決めると、無駄な試行を減らせます。
ラフプロンプト
最初は短いプロンプトで構図と動きを確認します。主題、動作、環境、カメラだけに絞り、スタイルや質感は後から足します。ラフで方向性が合わなければ、細部を詰めても意味がありません。
参照画像とキーフレーム
参照画像を使える場合は、顔、服装、背景、色味を別々に用意します。キーフレームを指定できるモデルでは、開始フレームと終了フレームを決め、その間の動きをプロンプトで補います。
生成・選別・修正
同じプロンプトで複数回生成し、構図、動き、一貫性、色、ディテールの五項目で評価します。合格点に達したら解像度を上げ、不足があれば一つの変数だけを変えて再生成します。
バージョン管理
プロンプトはテキストファイルや表計算で管理します。日付、目的、モデル、尺、プロンプト本文、参照画像、結果メモを残します。小さな変更履歴があると、後から再現できます。
反復改善とA/Bテスト
改善のコツは、一度に一つの変数だけを変えることです。照明、カメラ、語順、重み、ネガティブ指定を同時に変えると、何が効いたのか分からなくなります。
変数を一つだけ変える
例えば「逆光」を「柔らかい室内光」に変える、カメラを「固定」から「ゆっくりドリーイン」に変える、主題の記述を「女性」から「三十代の女性」に変える、といった具合です。各テストを短いクリップで行い、結果を記録します。
スコアリング
構図、動きの自然さ、キャラクター一貫性、色の整合性、ディテールの五段階評価をつけます。主観だけでなく、破綻の有無、目的との一致、編集での使いやすさも加えます。
失敗パターン診断
顔が崩れるなら参照画像と特徴記述を強化します。指が多いなら手の動作を単純化し、ネガティブ指定を加えます。カメラが勝手に動くならモーション指定を減らし、固定カメラを明示します。色が不自然なら光源とカラーパレットを整理します。
目的別プロンプトテンプレート
ここでは代表的な用途別に、プロンプトの組み立て例を示します。そのまま使うのではなく、自分の企画に合わせて調整してください。
商品紹介
「白い陶器のカップを木製テーブルに置く。手がゆっくりカップを掴み、湯気が立つ。朝の柔らかい窓光、浅い被写界深度、三十五ミリレンズ、ミディアムショット、固定カメラ、シネマティック、彩度控えめ、背景はぼかす。低品質、文字化け、余分な指を除外。」
人物ポートレート
「三十代の男性が窓辺に座り、外を見ている。白いシャツ、短い黒髪、落ち着いた表情。横顔のクローズアップ、アイレベル、ゆっくりしたパン、ブルーアワーの柔らかい光、リムライト、浅い被写界深度、ドキュメンタリー風、粒子感。」
風景・トラベル
「夜明けの山道をドローンが前進する。霧、杉林、遠くの湖、空は紫から橙へ。ローアングル気味のロングショット、ゆっくりした前進、広角レンズ、自然な色、高いダイナミックレンジ、息をのむような静けさ。」
抽象・タイトル
「黒い液体が水中で渦を巻き、金の粒子が浮かぶ。マクロレンズ、クローズアップ、ゆっくり回転、暗い背景、一筋のリムライト、高コントラスト、タイトル用の余白を右上に残す。急速な動き、ちらつき、過剰な彩度を除外。」
よくある失敗と対策
AI動画生成では、同じような失敗が繰り返されます。原因と対策を知っておくと、修正が速くなります。
被写体が崩れる
原因は、動作が複雑、参照が不足、解像度が低い、プロンプトが長すぎるなどです。対策は、動作を単純化し、参照画像を追加し、主題の記述を短く明確にし、必要ならクリップを分割します。
カメラが勝手に動く
モデルが動きを補完している場合があります。「固定カメラ」「三脚」「動きなし」を明示し、モーション指示を削ります。それでも動くなら、開始フレームを固定した画像生成から始めます。
色が不自然
照明とカラーパレットの指定が矛盾していると起こります。「暖色の室内光」と「青い月光」を同時に書くと、モデルはどちらかに引っ張られます。光源を一つに絞り、反射や影の色を補足します。
テンポが悪い
動きが速すぎる、カットが多すぎる、秒数が短すぎる場合に起こります。動きを「ゆっくり」にし、一クリップ一アクションにし、尺を少し伸ばして編集で調整します。
不要なテキストやロゴが入る
モデルが看板や背景に文字を生成することがあります。「文字なし」「ロゴなし」「看板なし」をネガティブ指定に加え、背景を単純化します。
よくある質問
プロンプトは長ければ長いほど良いですか
いいえ。長すぎると重要度が分散し、矛盾も増えます。まずは主題、動作、環境、カメラの四つに絞り、必要に応じて照明、スタイル、除外要素を足します。
同じプロンプトで毎回同じ結果になりますか
完全には同じになりません。乱数シード、モデルバージョン、解像度、参照画像の有無で変わります。再現性を高めるには、シード固定、参照画像、バージョン管理を組み合わせます。
日本語と英語のどちらで書くべきですか
モデルによります。英語の学習データが多いモデルでは英語が安定することがあります。日本語に対応したモデルなら、日本語で具体性を出し、固有名詞やカメラ用語だけ英語を併記する方法も有効です。
ネガティブ指定は必須ですか
必須ではありませんが、リアリズム系では効果が高いです。まずはポジティブ指定だけで試し、崩れや不要物が出たときに追加します。
参照画像は何枚必要ですか
顔、服装、背景、色味を分けるなら二枚から四枚が目安です。多すぎると矛盾し、少なすぎると一貫性が弱くなります。
カメラワークはどこまで指定できますか
モデルにより差があります。固定、パン、ティルト、ドリー、ズーム、手持ち風は比較的指定しやすいです。複雑なカット割りはクリップを分ける方が安定します。
動画の尺はどれくらいが良いですか
短尺SNSなら三秒から八秒、商品紹介なら五秒から十秒、物語なら十秒以上を分割してつなぐ方法が実用的です。一つの生成で長尺を狙うより、短いクリップを組み合わせる方が制御しやすいです。
失敗したプロンプトはどう保存すべきですか
失敗も記録します。何を変えたら何が悪化したかが分かると、次回の判断が速くなります。成功例だけでなく、失敗例と修正メモをセットで残します。
商用利用で注意することはありますか
利用するモデルやサービスの規約、学習データの扱い、著作権、肖像権、商標を確認します。生成物の権利は地域やサービスで異なるため、公開前に必ず確認してください。
初心者が最初に覚えるべきことは何ですか
主題、動作、環境、カメラの四つを一行ずつ書くことです。次に照明とスタイルを足し、最後にネガティブ指定を加えます。この順番を守るだけで、結果のばらつきが減ります。
最後に:プロンプト設計を習慣にする
AI動画生成のプロンプト設計は、特別な才能ではなく、観察と記録の積み重ねです。うまくいったプロンプトを保存し、なぜうまくいったのかを言葉にし、失敗から変数を一つずつ変えて検証します。主題、動作、環境、カメラ、照明、スタイル、除外要素という基本構造を押さえれば、どんなモデルでも応用できます。最初は短いクリップで試し、慣れてきたら参照画像やキーフレーム、カット割りに挑戦してください。目的を明確にし、制約を守り、反復する。その地味な工程こそが、思い通りのAI動画を安定して生み出す最短ルートです。



