主体与身份锚点
记录人物或物体的外观、服装、姿态、相对位置与稳定特征。无法确认的姓名、关系和动机保持未知,不把推测写成事实。
图片反推提示词,是从一张参考图中提取可观察的视觉事实,再按生成模型容易理解的顺序组织成提示词;重点是忠实、结构清楚和可继续修改,而不是猜测图片背后的故事。
一张图的有效信息有层级。先锁定不会轻易改变的身份和空间事实,再补充审美与画质语言,能减少模型只学到“氛围”、却丢失主体和构图的问题。
记录人物或物体的外观、服装、姿态、相对位置与稳定特征。无法确认的姓名、关系和动机保持未知,不把推测写成事实。
说明景别、视角、主体占比、前中后景、遮挡、焦点与景深。与“电影感”相比,这些信息更具体,也更容易被复现。
描述主光方向、软硬程度、色温、明暗关系、配色、表面质感和真实度,同时列出需要避免的漂移、畸变与新增元素。
整个流程围绕“观察—结构化—校对”展开。结构化结果可以继续用于图片生成,也可以作为视频首帧、尾帧和角色一致性的基础。
优先使用未经过度压缩、主体边界清楚的图片。若画面包含多人或复杂物体,先确定谁是主角,以及哪些区域不能被模型随意补全。
按主体、环境、构图、镜头、光线、色彩、材质逐项拆解。镜语会把事实与不确定项分开,避免把情绪原因、人物关系等猜测混入正文。
生成中文和英文版本后,检查是否出现原图没有的道具、动作或身份。再根据即梦、可灵或其他模型的输入方式压缩和调整。
关键词堆得越多,不代表结果越稳定。真正影响生成的是信息是否互相一致、是否有明确优先级,以及是否把静态画面和运动过程混在一起。
“电影感、唯美、高清”无法说明人物在哪里、镜头怎么拍、光从哪里来。应先写事实骨架,再补充风格和质量要求。
仅凭表情无法确认人物关系与心理动机。镜语把不确定项单列,既提高忠实度,也让后续创作修改更有边界。
多人遮挡、手部、发丝和复杂背景容易漂移。把“不要新增主体、不要改变服装、不要补全不可见人物”等限制显式写出更稳妥。
提示词不是源文件。不同模型、版本、参数、参考图权重和随机性都会改变结果,因此应把反推结果视为高质量起点,而不是虚假保证。
不等于。内容识别只是第一层,高质量反推还要描述空间关系、构图、镜头、光线、色彩、材质和负面约束。
可以。两种语言应共享同一事实骨架,而不是逐字硬译;英文版会使用更适合模型理解的视觉描述顺序。
不能保证。镜语尽量减少信息损失,但最终生成仍受模型能力、参数、随机种子、参考图和平台规则影响。