Image to Prompt

图片反推提示词:把参考图拆成可编辑的视觉语言

镜语提示词反推器不只回答“图里有什么”,还把主体身份、空间关系、构图、镜头、光线、色彩、材质和限制条件整理成可复用的中英文 Prompt。

一句话答案

图片反推提示词,是从一张参考图中提取可观察的视觉事实,再按生成模型容易理解的顺序组织成提示词;重点是忠实、结构清楚和可继续修改,而不是猜测图片背后的故事。

高质量图片 Prompt 应该包含什么

一张图的有效信息有层级。先锁定不会轻易改变的身份和空间事实,再补充审美与画质语言,能减少模型只学到“氛围”、却丢失主体和构图的问题。

主体与身份锚点

记录人物或物体的外观、服装、姿态、相对位置与稳定特征。无法确认的姓名、关系和动机保持未知,不把推测写成事实。

构图与镜头

说明景别、视角、主体占比、前中后景、遮挡、焦点与景深。与“电影感”相比,这些信息更具体,也更容易被复现。

光线、色彩与材质

描述主光方向、软硬程度、色温、明暗关系、配色、表面质感和真实度,同时列出需要避免的漂移、畸变与新增元素。

从图片到提示词的三步流程

整个流程围绕“观察—结构化—校对”展开。结构化结果可以继续用于图片生成,也可以作为视频首帧、尾帧和角色一致性的基础。

1

导入清晰原图

优先使用未经过度压缩、主体边界清楚的图片。若画面包含多人或复杂物体,先确定谁是主角,以及哪些区域不能被模型随意补全。

2

提取视觉事实

按主体、环境、构图、镜头、光线、色彩、材质逐项拆解。镜语会把事实与不确定项分开,避免把情绪原因、人物关系等猜测混入正文。

3

输出并人工校对

生成中文和英文版本后,检查是否出现原图没有的道具、动作或身份。再根据即梦、可灵或其他模型的输入方式压缩和调整。

本地工作流项目、历史和素材管理保存在本机
中英双语同一视觉事实,两种可编辑表达
结构化输出事实、Prompt、限制条件分区
可接多模型支持兼容接口与自选服务商

图片反推最常见的误区

关键词堆得越多,不代表结果越稳定。真正影响生成的是信息是否互相一致、是否有明确优先级,以及是否把静态画面和运动过程混在一起。

把风格词当成完整 Prompt

“电影感、唯美、高清”无法说明人物在哪里、镜头怎么拍、光从哪里来。应先写事实骨架,再补充风格和质量要求。

把推测写成事实

仅凭表情无法确认人物关系与心理动机。镜语把不确定项单列,既提高忠实度,也让后续创作修改更有边界。

忽略负面约束

多人遮挡、手部、发丝和复杂背景容易漂移。把“不要新增主体、不要改变服装、不要补全不可见人物”等限制显式写出更稳妥。

承诺百分之百复刻

提示词不是源文件。不同模型、版本、参数、参考图权重和随机性都会改变结果,因此应把反推结果视为高质量起点,而不是虚假保证。

常见问题

图片反推提示词等于识别图片内容吗?

不等于。内容识别只是第一层,高质量反推还要描述空间关系、构图、镜头、光线、色彩、材质和负面约束。

一张图片可以生成中文和英文 Prompt 吗?

可以。两种语言应共享同一事实骨架,而不是逐字硬译;英文版会使用更适合模型理解的视觉描述顺序。

反推结果能百分之百复刻原图吗?

不能保证。镜语尽量减少信息损失,但最终生成仍受模型能力、参数、随机种子、参考图和平台规则影响。