先写主体和动作
开头先说明画面里是谁或什么,以及他/它在做什么。一个清晰的动作比一堆互不相关的细节更容易被理解。
简短交代环境即可。核心动作明确之后,模型会自动补足质感细节。
描述镜头
镜头语言非常关键。诸如广角定场镜头、中近景、缓慢推进、手持跟拍等描述,会告诉模型镜头该如何运动。
每个片段只选一种运动方式。在一个短镜头里叠加多种相互冲突的运镜,通常会让画面运动变得混乱。
设定灯光与氛围
黄金时刻、阴天、霓虹灯、单点柔光等灯光关键词,能让渲染结果保持统一的观感。
结尾加一两个氛围词即可。保持描述简短,因为每多一个描述词都会分散模型的注意力。
提示词常见问题
提示词应该写多长?
通常一到三句话就够了。涵盖主体、动作、镜头和灯光后即可停止。
应该用英文写吗?
目前主流的视频模型对英文提示词的支持通常最好。
为什么片段忽略了部分提示词?
短片段能容纳的细节有限。先删减描述词直到核心动作清晰,再逐条把细节加回来。
提示词长度会影响积分消耗吗?
不会。成本取决于片段时长和分辨率,与提示词长度无关。