
AI動画プロンプトの書き方:構成と具体例
On this page
「スローオービット(低速周回)。高速手持ちトラッキング。固定カメラ。」それぞれのフレーズは、単体なら映画のような響きを持っています。しかし、これらを一つの短いプロンプトに詰め込んでしまうと、モデルは3つの矛盾するカメラ指示を受け取ることになります。効果的なAI動画プロンプトとは、被写体、アクション、フレーミング、カメラワーク、ライティング、タイミング、そしてサウンドのそれぞれに、明確な役割を一つずつ与えたものです。
このガイドでは、その構成を1カットずつ組み立てていく方法を解説します。プロンプトを書き、モデルがどの指示に従ったかを確認し、問題の原因となっている指示だけを修正していくプロセスを学びましょう。
AI動画プロンプトでコントロールすべき要素
画像のプロンプトは「1コマのフレーム」を描写しますが、動画のプロンプトは「次に何が変化するか」を説明する必要があります。具体的には、被写体のアクション、カメラの挙動、環境、ペース、そして対応している場合はサウンドです。また、ネガティブプロンプト(除外したい要素)を並べ立てるのではなく、守るべき「最も重要なディテール」を一つに絞って制限をかけるのがコツです。
実用的なゴールは、読みやすい「1カット」を作ることです。複数のアクション、カメラワーク、ロケーション、雰囲気を詰め込みすぎると、思い通りの結果にならない原因を特定するのが難しくなります。
このルールはシネマティックなAIプロンプトを作成する際にも役立ちます。雰囲気(アトモスフィア)は、目に見える出来事を引き立てるために使うべきであり、出来事そのものの代わりにしてはいけません。
実用的なAI動画プロンプトの構成
Adobeの現在の動画プロンプトガイドでは、Fireflyのプロンプトを「ショットタイプ、キャラクター、アクション、ロケーション、エステティック(美学)」を中心に整理することを推奨しています。この基本骨組みに、タイミング、オーディオ、そして一つの重要な制限事項を加えます。

[ショットサイズと構図] + [被写体] + [目に見えるアクション] +
[カメラワークと方向] + [環境、ライティング、スタイル] +
[タイミングとペース] + [オーディオキュー(対応している場合)] + [一つの重要な制限事項]
現在のLoova AI Text to Video(テキストから動画生成)ワークスペースには、モデルセレクター、プロンプト入力欄、プロンプトアシスタント、および詳細設定が用意されています。この構成を適用する前に、選択したモデルがどのコントロールに対応しているかを確認してください。
被写体とアクション
視聴者が認識できる詳細な情報を使ってメインの被写体を指定し、それに「目に見えるアクション」を一つ与えます。「希望に満ちた様子」といった抽象的な表現は、姿勢、表情、動きの速度、天気、色、あるいはその他の目に見える手がかりに翻訳して記述します。
ショットサイズと構図
ショットサイズによって、画面に入る情報の量が決まります。クローズアップは表情や質感を際立たせ、ワイドショットはアクションや環境を広く見せるのに適しています。中央配置、手前左、ネガティブスペース(余白)などの構図の指示は、配置が重要な意味を持つ場合にのみ追加します。
カメラワークと方向

カメラワークは、複数の動きを重ねるよりも、明確に指定された一つの動きにする方が評価しやすくなります。「ボトルに向かってゆっくりプッシュイン(ズームイン)」と書き、その方向や終点を指定します。被写体の動きとカメラの動きを切り離して記述することで、それぞれの軌道が明確になります。
ライティング、スタイル、環境
ライティングには、光源と質感を指定します。例えば「左側からの柔らかい窓の光」や「濡れた路面に反射する青い店舗のネオン」などです。また、「ドキュメンタリー風」「ストップモーション」「スタジオCM風」といった言葉を使って、ビジュアルの方向性を決定します。具体的な素材(コンクリートの表面など)や色彩を指定する方が、「シネマティック」という言葉を繰り返すよりも効果的です。
タイミング、ペース、オーディオキュー
タイミングは、「4秒かけて徐々に映し出し、その後2秒間静止する」というように、目に見える変化と結びつけます。オーディオの生成はモデルに依存します。LTXの動画プロンプトガイドでは、同期オーディオを生成できるLTX-2.5向けにセリフ、環境音、音楽を紐づけています。オーディオ非対応のモデルを使用する場合は、これらのメモを後からの編集用として残しておきましょう。
ステップ・バイ・ステップのプロンプト作成フロー
1. シンプルな1カットから始める
まずは最も要素の少ないバージョンを書きます。「ショットサイズ、被写体、一つのアクション、一つのカメラワーク」です。小道具、トランジション、詳細なサウンドを追加する前に、この基本形が正しく出力されるかを確認します。
2. 動きとタイミングを追加する
基本のカットがクリアに再現されたら、方向、速度、終点を追加します。「カメラが動く」という指示を、「カメラがゆっくりとプッシュインし、手のクローズアップで停止する」のように具体化します。秒数(デュレーション)を指定するのは、展開の順序を変えたい場合のみにします。
3. 生成、診断、そして修正

Loova AI テキスト動画生成ツールまたはお使いのモデルのインターフェースで、基本プロンプトを実行します。被写体、アクション、フレーミング、カメラ、ライティング、タイミング、オーディオを個別にチェックし、思い通りにいかなかった最初の要素だけを修正します。
2つのAI動画プロンプト具体例
これらは書き方の例であり、特定のテスト結果を保証するものではありません。被写体、サイズ、タイミング、オーディオは、使用するモデルや配信フォーマットに合わせて適宜変更してください。
プロダクトマーケティング動画のプロンプト例
薄い石の台座の上に置かれた、ブランドロゴのない琥珀色のガラス製スキンケアボトルのクローズアップショット。ボトルは直立したままで、その周囲を水が円を描くように流れている。カメラは左から右へ30度ゆっくりと周回(オービット)し、ボトルの正面で停止する。カメラの左側から、すっきりとしたニュートラルなスタジオ背景に対して、柔らかい朝の光が差し込んでいる。全体で6秒:最初の5秒で展開し、最後の1秒は静止。オーディオに対応している場合は、静かな水の音と柔らかなガラスのチャイム音。ボトルの形状を維持し、余計なテキストは画面に入れないこと。
水とカメラにそれぞれ異なる動きを与えつつ、最後の1行で製品の形状が崩れるのを防いでいます。最後に静止時間を設けることで、編集でエンドカード(ロゴなど)を挿入する余白を作っています。
Code