AI 视频结构化提示词模板
一句话:用主体、环境、动作、镜头、光线、声音和约束七个部分稳定描述一个 AI 视频镜头。
它是什么
结构化视频提示词把模糊创意拆成可控制的镜头信息:谁或什么是主体、位于什么环境、发生什么动作、相机如何观察、光线和色彩是什么、是否需要对白或环境声,以及哪些内容不能改变。它的目的不是把提示词写得越长越好,而是减少相互冲突的要求,让失败后能够判断具体是哪一部分需要修改。
适合干什么
- 适合刚接触文生视频、图生视频、产品广告、人物短片和需要团队统一写法的创作者。
不适合干什么
- 不适合把完整故事、多个场景和多次转折全部塞进一个短镜头,也不适合使用大量无法验收的形容词。
普通人怎么用
先只写一个主体、一个动作和一个运镜,生成后再逐步加入光线、声音和细节约束。
进阶用户怎么用
进阶用户可为不同模型建立专用模板,并记录哪些字段对人物、产品、动画和写实镜头最敏感。
常见误区
- 常见误区是提示词越长越专业。过长提示词会让模型忽略重点,尤其是动作、运镜和场景要求互相冲突时。
和相似工具的区别
- 普通文案提示词强调表达,视频提示词强调时序和运动。
- 分镜脚本描述整段内容,单镜头提示词只负责一个镜头。
- 负面约束用于保护关键细节,不能代替正向描述。
入门步骤
- 选择一个 5 至 8 秒镜头,用七段模板写出第一版,生成后只修改一个字段并比较结果。