---
name: 反推视频提示词
description: 分析视频，反推出可用于 AI视频生成模型的高质量提示词。适用于用户要求反推提示词、复刻画面、分析镜头语言、生成同款视频提示词等场景。
metadata:
    tools: [vision]
---


# 视觉提示词反推
根据用户提供的图片或视频，调用 `vision` 工具分析视觉内容，并生成可复现其视觉效果的提示词。

## 工具
使用 `vision`：
- `path`：本地图片或视频路径
- `prompt`：需要视觉模型分析的问题
- 视频文件必须小于 600 MB

## 基本原则
1. 反推结果是对画面特征的重建，不能宣称恢复了原始提示词。
2. 优先描述可观察到的内容，不把不确定信息写成事实。
3. 不识别或猜测现实人物身份，只描述其可见外观和视觉特征。

## 工作流程
### 1. 确认任务
从用户请求中提取：
- 文件路径
- 类型：图片或视频
- 目标：复刻、风格参考、人物参考、运镜参考或完整反推
- 是否需要负面提示词
- 是否需要生成参数
信息缺失但不影响分析时直接采用默认值，不要反复追问。

### 2. 首次视觉分析
调用 `vision`，使用以下分析提示词。
图片：
> 请详细分析这张图片，以便将其重建为 AI 图片生成提示词。只描述画面中能够观察到的内容。依次分析：主体及其外观、动作和表情、环境、构图、景别、视角、镜头或焦段观感、光线方向和光质、色彩、材质、景深、视觉风格、后期质感、画面比例，以及容易遗漏的细节。区分确定信息与不确定推测。最后给出影响画面相似度最大的视觉要素。

视频：
> 请完整分析这个视频，以便将其重建为 AI 视频生成提示词。按时间顺序分析：主体、环境、动作过程、镜头运动、景别和视角变化、构图、光线、色彩、材质、视觉风格、节奏、速度、物理运动、前后帧连续性、转场和结尾状态。请给出分镜时间线，并区分主体运动与摄影机运动。只描述能够观察到的内容，不猜测不可见信息。最后列出影响视频相似度最大的视觉要素。

### 3. 针对性补充分析
如果首次结果缺少关键细节，再调用一次 `vision`。不要无目的重复分析。
图片补充提示词：
> 请重新检查该图片，重点补充容易影响生成相似度的细节：主体数量和空间关系、手部和姿态、服装或物体材质、背景层次、光源位置、阴影、焦点位置、景深、镜头畸变、颗粒感、调色和画面比例。指出此前描述中可能不准确或存在歧义的部分。

视频补充提示词：
> 请重新检查该视频，重点核对每个镜头的持续时间、主体动作起止状态、摄影机运动方向和速度、焦点变化、遮挡关系、转场、运动模糊、物理交互及跨帧一致性。输出适合写入视频生成提示词的精确动作和运镜描述。

### 4. 组织提示词
图片提示词按照以下顺序组织：
`主体 + 外观细节 + 动作/表情 + 环境 + 构图/景别 + 镜头视角 + 光线 + 色彩 + 材质 + 风格 + 画质`

视频提示词按照以下顺序组织：
`初始画面 + 主体动作时间线 + 环境变化 + 摄影机运动 + 光线与色彩 + 运动节奏 + 物理表现 + 连续性约束 + 结束画面`

不要堆砌相互冲突的风格词。优先保留对结果影响最大的具体描述。

## 输出格式
### 视觉分析
简明概括主体、场景、构图、光影、风格。视频额外概括动作和运镜。

### 中文提示词
输出一段可直接使用的完整提示词。

### 负面提示词
仅包含与目标画面相关的排除项，例如：

- 错误主体数量
- 人体或手部畸形
- 构图错误
- 不需要的镜头运动
- 闪烁、跳帧、形变
- 风格或画质偏差

不要无意义地堆积通用负面词。

### 建议参数
仅在能够合理判断或用户要求时提供：

- 画面比例
- 时长和帧率
- 镜头运动强度
- 风格化强度

无法从视觉内容判断的参数标记为“建议值”，不要冒充原始参数。

### 不确定项
列出可能存在多种解释、无法从素材确认的内容。

## 视频分镜规则
视频包含多个镜头时，额外输出：
| 时间段 | 画面内容 | 主体动作 | 摄影机运动 | 光线/转场 |
|---|---|---|---|---|

然后提供：
1. 一条完整视频提示词
2. 每个镜头的独立提示词
3. 跨镜头一致性要求

如果更适合单镜头生成，应明确建议分镜生成后再剪辑，不要把复杂多镜头硬塞入一个提示词。


## 质量检查
输出前确认：
- 主体数量、方向和动作没有遗漏
- 摄影机运动与主体运动已明确区分
- 没有加入素材中不存在的关键物体
- 提示词内部不存在风格、光线或运镜冲突
- 视频提示词包含起始状态、动作过程和结束状态
- 提示词可直接用于生成，而不只是分析报告