起始状态
动作发生前,主体姿态、视线、手脚位置、物体状态和摄影机状态是什么。起点写得模糊,模型就会自行创造准备动作。
运动反推提示词不是给静态画面添加“缓慢、电影感”等形容词,而是说明谁从什么状态开始、沿什么轨迹、以怎样的速度变化,并在何处结束,同时约束摄影机和环境不要抢走主要事件。
运动语言需要时间关系。每个部分都应能回答具体问题,并与关键帧中的可见证据一致。
动作发生前,主体姿态、视线、手脚位置、物体状态和摄影机状态是什么。起点写得模糊,模型就会自行创造准备动作。
主体向哪个方向移动,身体哪些部位先动,动作是否经过中间姿态。使用“低头—停留—抬头”比单写“抬头”更能保持顺序。
说明匀速、渐快、渐慢、短暂停顿或分阶段变化。节奏应服务单一主要事件,避免同时要求多组互相竞争的大动作。
衣物、发丝、尘雾、水面或道具如何被主体动作影响。只写有证据或符合物理因果的反馈,不凭空制造强风、爆炸或粒子。
明确固定、跟随、平移、推进或轻微手持。先确定主体动作,再决定镜头是否需要响应,防止不必要的推拉摇移破坏可读性。
动作完成后主体和镜头停在哪里,视线朝向何处,画面如何收束。清晰终点能减少循环动作、重复动作和突然回弹。
镜语先让每张关键帧只描述自己的静态状态,再让跨帧分析只处理变化。这样可以避免在首帧写“正在抬头”,或在尾帧继续描述尚未结束的过程。
首帧描述动作开始前的定格,尾帧描述动作完成后的定格。两者不夹带“逐渐、正在、即将”等过程词。
用中间帧判断动作顺序、峰值姿态、短暂停顿、遮挡和速度变化。相似帧不重复写,只保留能改变运动判断的证据。
先写主体动作,然后写道具或环境如何受影响,最后写摄影机响应和结束状态。读者和模型都能更快找到主事件。
真实案例中的运动拆解
在真实的 15 秒人物案例里,最终判断不是笼统的“女性有情绪地看向对方”,而是:头部缓慢向下、视线下移、眼睑闭合、短暂停留、随后平缓抬头、眼睑重新睁开并恢复稳定注视。镜头基本固定,发丝只发生轻微摆动。
保持连续单镜头;唯一主要事件是低头回避后重新面对前景人物。注意力路径由湿润的眼睛移到低下的头部,再回到重新建立的视线。
不颠倒动作顺序,不重复低头或抬头,不产生头部瞬移,不添加拥抱、转身、对白或无依据的推拉摇移,不改变发型、服装和人物数量。
离散帧能支持很多时序判断,但不能证明所有真实运动。准确的做法是把观察、推断和生成控制分开。
可见位置变化、姿态变化、动作顺序、明显停顿、视线方向、物体状态变化、切镜与大多数显著运镜。
极轻微机位修正、动作心理动机、被遮挡部位的连续轨迹、采样间隔内的瞬时动作,以及没有音频证据的节拍和对白。
视频提示词还包含主体外观、环境、构图和风格;运动提示词更集中描述状态变化、轨迹、速度、物理反馈和摄影机响应。
通常先定义主要主体动作,再写环境与物理反馈,最后说明摄影机如何响应,能让因果关系和视觉优先级更清楚。
没有终点时,模型容易重复动作、回弹或在片尾继续变化。明确主体姿态、视线和镜头收束能提高稳定性。