Motion Prompt

运动反推提示词:写清楚“怎么动”,而不是只写“动起来”

镜语把人物动作、物体运动、环境变化、物理反馈与摄影机运动拆开,再按起点、轨迹、速度、节奏和终点重组为可执行的 Motion Prompt。

一句话答案

运动反推提示词不是给静态画面添加“缓慢、电影感”等形容词,而是说明谁从什么状态开始、沿什么轨迹、以怎样的速度变化,并在何处结束,同时约束摄影机和环境不要抢走主要事件。

一个可执行的 Motion Prompt 有五个核心部分

运动语言需要时间关系。每个部分都应能回答具体问题,并与关键帧中的可见证据一致。

起始状态

动作发生前,主体姿态、视线、手脚位置、物体状态和摄影机状态是什么。起点写得模糊,模型就会自行创造准备动作。

主要轨迹

主体向哪个方向移动,身体哪些部位先动,动作是否经过中间姿态。使用“低头—停留—抬头”比单写“抬头”更能保持顺序。

速度与节奏

说明匀速、渐快、渐慢、短暂停顿或分阶段变化。节奏应服务单一主要事件,避免同时要求多组互相竞争的大动作。

物理与环境反馈

衣物、发丝、尘雾、水面或道具如何被主体动作影响。只写有证据或符合物理因果的反馈,不凭空制造强风、爆炸或粒子。

摄影机响应

明确固定、跟随、平移、推进或轻微手持。先确定主体动作,再决定镜头是否需要响应,防止不必要的推拉摇移破坏可读性。

结束状态

动作完成后主体和镜头停在哪里,视线朝向何处,画面如何收束。清晰终点能减少循环动作、重复动作和突然回弹。

从关键帧证据到运动语言

镜语先让每张关键帧只描述自己的静态状态,再让跨帧分析只处理变化。这样可以避免在首帧写“正在抬头”,或在尾帧继续描述尚未结束的过程。

1

锁定首尾状态

首帧描述动作开始前的定格,尾帧描述动作完成后的定格。两者不夹带“逐渐、正在、即将”等过程词。

2

提取中间阶段

用中间帧判断动作顺序、峰值姿态、短暂停顿、遮挡和速度变化。相似帧不重复写,只保留能改变运动判断的证据。

3

按因果顺序编译

先写主体动作,然后写道具或环境如何受影响,最后写摄影机响应和结束状态。读者和模型都能更快找到主事件。

真实案例中的运动拆解

“低头后重新抬眼”为什么需要时间线

在真实的 15 秒人物案例里,最终判断不是笼统的“女性有情绪地看向对方”,而是:头部缓慢向下、视线下移、眼睑闭合、短暂停留、随后平缓抬头、眼睑重新睁开并恢复稳定注视。镜头基本固定,发丝只发生轻微摆动。

正确的运动主线

保持连续单镜头;唯一主要事件是低头回避后重新面对前景人物。注意力路径由湿润的眼睛移到低下的头部,再回到重新建立的视线。

明确禁止的漂移

不颠倒动作顺序,不重复低头或抬头,不产生头部瞬移,不添加拥抱、转身、对白或无依据的推拉摇移,不改变发型、服装和人物数量。

结构模板:镜头模式 → 导演主任务 → 起始状态 → 主体动作轨迹 → 速度曲线与停顿 → 环境/物理反馈 → 摄影机响应 → 结束状态 → 负面运动约束。

运动反推的边界

离散帧能支持很多时序判断,但不能证明所有真实运动。准确的做法是把观察、推断和生成控制分开。

可以较可靠描述

可见位置变化、姿态变化、动作顺序、明显停顿、视线方向、物体状态变化、切镜与大多数显著运镜。

需要谨慎描述

极轻微机位修正、动作心理动机、被遮挡部位的连续轨迹、采样间隔内的瞬时动作,以及没有音频证据的节拍和对白。

常见问题

运动提示词和视频提示词有什么区别?

视频提示词还包含主体外观、环境、构图和风格;运动提示词更集中描述状态变化、轨迹、速度、物理反馈和摄影机响应。

运镜应该写在动作前还是动作后?

通常先定义主要主体动作,再写环境与物理反馈,最后说明摄影机如何响应,能让因果关系和视觉优先级更清楚。

为什么结束状态必须明确?

没有终点时,模型容易重复动作、回弹或在片尾继续变化。明确主体姿态、视线和镜头收束能提高稳定性。