提示词是 AI 视频生成的方向盘,写法决定了画面动还是静、快还是慢、镜头推还是拉。
和 AI 绘图不同,AI 视频的提示词不仅要描述"画面是什么",更要描述"画面怎么变"。一条好的视频提示词,本质上是在给 AI 下达一份运动指令书。
你可以把它拆成三个维度来写:
把这三个维度拆开写,你的提示词会立刻清晰很多。
写动作时最大的错误是太笼统。"一个人在走"可以有一百种走法,AI 会随机选一种,大概率不是你想要的。
对比:
具体化的关键要素:
| 要素 | 例子 | 为什么重要 |
|---|---|---|
| 方向 | 从左到右 / 向镜头走来 | 决定了画面变化的基本轨迹 |
| 速度 | 匀速 / 加速 / 慢动作 | 影响观感和节奏 |
| 身体部位 | 头部转动 / 手臂抬起 | 越具体的部位越容易准确执行 |
| 幅度 | 微微 / 大幅 | 控制运动量,避免过度变形 |
一个小技巧:动作幅度尽量写"微微"。AI 视频在大动作时最容易崩,微动作的成功率高得多。
AI 视频工具普遍支持电影术语来控制镜头。掌握以下几个就够覆盖大多数场景:
组合写法示例:
镜头缓慢推进,女孩微微抬头,风吹动她的头发,背景树叶轻摇
这条提示词同时包含了镜头(推进)、主体动作(抬头、头发被吹)和环境(树叶摇动),层次分明,AI 执行起来不容易混乱。
一条提示词只写一个镜头运动。 不要写"镜头先推后拉再旋转",AI 目前处理不了连续的复杂运镜。如果需要多段运镜,分多次生成再剪辑。
AI 视频的单次生成时长通常在 3-10 秒之间,具体取决于工具。你不能直接在提示词里写"生成 15 秒视频",但可以通过以下方式间接控制节奏:
用速度词控制单帧内节奏:
用"逐渐"控制变化过程:
生成时长的实际策略:
| 需要时长 | 策略 |
|---|---|
| 3-5 秒 | 单次生成,选短时长档位 |
| 5-10 秒 | 单次生成,选长时长档位 |
| 10-20 秒 | 链式生成 2-3 段,剪辑拼接 |
| 20 秒以上 | 考虑用图片+配音为主,AI 视频只做关键段 |
最后给你一个可以直接套用的模板:
[镜头运动], [主体] [具体动作], [环境/背景变化], [速度/氛围词]
填几个实例:
多写几条,你就找到感觉了。提示词不是"写"出来的,是"调"出来的——第一次不完美很正常,改一两个词再跑一次就好。