
如何撰写 AI 视频提示词:结构与示例
On this page
“慢速轨道。快速手持追踪。静态摄像机。”每个短语单独听起来都很有电影感。但如果把它们放在同一个简短的提示词中,模型就会收到三个相互冲突的镜头方向。一个实用的 AI 视频提示词应该让主体、动作、构图、镜头运动、光影、节奏和声音各司其职,分工明确。
本指南将向您展示如何一步一个镜头地构建这种结构。您将编写一个提示词,检查模型的执行效果,并仅针对出现问题的指令进行修改。
AI 视频提示词需要控制什么
图像提示词描述的是一个画面。而视频提示词还必须解释接下来的变化:主体动作、镜头行为、环境、节奏以及支持的音效。限制条件应该保护一个核心细节,而不是列出所有不想要的结果。
实际的目标是呈现一个清晰可读的镜头。过多的动作、镜头移动、场景和情绪会让结果难以诊断。
同样的原则也适用于提升电影感 AI 提示词:氛围应该服务于可见的事件,而不是取代它。
实用的 AI 视频提示词结构
Adobe 当前的视频提示词指南围绕镜头类型、角色、动作、场景和美学来组织 Firefly 提示词。这个框架在此基础上增加了时间、音频和一个核心限制条件。

[镜头尺寸与构图] + [主体] + [可见动作] +
[镜头运动与方向] + [环境、光影与风格] +
[时间与节奏] + [音频提示,如支持] + [一个核心限制条件]
当前的 Loova AI 文本生成视频工作区提供了模型选择器、提示词输入框、提示词助手和其他设置。在调整框架之前,请先检查所选模型开放了哪些控制功能。
主体与动作
用观众可以识别的细节来命名主体,然后给它一个可见的动作。将“感到希望”转化为姿态、表情、速度、天气、颜色或其他可观察到的线索。
镜头尺寸与构图
镜头尺寸决定了能容纳多少信息。特写镜头有利于表现表情或纹理;全景镜头则给动作和环境留出更多空间。只有在位置至关重要时,才添加居中、前景左侧或留白等构图方向。
镜头运动与方向

单一明确的镜头移动比多个重叠的移动更容易评估。写下“向瓶子缓慢推近”,然后说明其方向或终点。将其与主体动作分开,使每个运动都有独特的路径。
光影、风格与环境
给光影一个光源和质感:例如“左侧柔和的窗光”或“湿漉漉的人行道上蓝色的商店橱窗光”。使用纪录片、定格动画或商业广告来设定视觉基调。具体的材质表面和颜色比重复“电影感”一词更有效。
时间、节奏与音频提示
将时间与可见的事物联系起来,例如“4 秒的揭示,随后是 2 秒的定格”。音频取决于模型。LTX 视频提示词指南将对话、环境音和音乐与 LTX-2.5 绑定,因为它能生成同步音频。如果使用其他不支持音频的模型,请将这些标注留到后期剪辑中处理。
逐步提示词工作流
从一个清晰的镜头开始
先写最精简的版本:镜头尺寸、主体、一个动作和一个镜头选择。在添加道具、过渡或详细声音之前,先保持这个控制变量不变并保存。
添加运动与时间
在镜头表达清晰后,添加方向、速度和终点。将“镜头移动”细化为“镜头缓慢推近,并在手部特写处停止”。只有在改变节奏顺序时才使用时长限制。
生成、诊断与修改

在 Loova AI 文本生成视频工具或您打算使用的模型界面中运行该控制版本。分别审查主体、动作、构图、镜头、光影、时间和音频。仅修改第一个失败的元素。
两个完整的 AI 视频提示词示例
这些是写作示例,而非实际测试结果。请根据您打算使用的模型和输出格式,替换主体、尺寸、时间和音频等选项。
产品营销视频提示词
无品牌琥珀色玻璃护肤品瓶子放置在淡色石质底座上的产品特写镜头。瓶子保持直立,水流环绕其底部。镜头从左向右进行 30 度的慢速轨道旋转,并在瓶子正面结束。柔和的晨光从镜头左侧射入,背景为干净的中性工作室背景。时长 6 秒:前 5 秒揭示,后 1 秒定格。如果支持音频,伴有安静的水声和柔和的玻璃鸣响。保留瓶子的形状,避免画面中出现添加的文字。
水流和镜头有各自独立的运动,而最后一行保护了产品的形状。最后的定格为剪辑片尾留出了空间。
代码