看到一条喜欢的视频,怎么用 AI 做出类似的?
用 PromptHub 视频反推把参考视频拆成结构化提示词,然后分四步复刻:反推拿到镜头字段;用画面提示词生成每个镜头的首帧;用视频提示词把首帧变成动态镜头;多镜头时把全局锚点附加到每个镜头以保持角色和环境一致。快速分析 6 点可拿到整体风格与完整镜头列表,精确分析每场景 2 点可拿到逐镜头的画面提示词、负向提示词和九项运镜字段。需要明确的是,复刻的是镜头语言与视觉风格,不是逐帧相同的画面。
看到一条喜欢的视频,怎么用 AI 做出类似的?
直接答案
用 PromptHub 视频反推把参考视频拆成结构化提示词,然后分四步复刻:反推拿到镜头字段;用画面提示词生成每个镜头的首帧;用视频提示词把首帧变成动态镜头;多镜头时把全局锚点附加到每个镜头以保持角色和环境一致。快速分析 6 点可拿到整体风格与完整镜头列表,精确分析每场景 2 点可拿到逐镜头的画面提示词、负向提示词和九项运镜字段。需要明确的是,复刻的是镜头语言与视觉风格,不是逐帧相同的画面。
先想清楚你要复刻的是什么
同样说"做个类似的",实际需求差别很大,直接决定后面怎么做:
| 你想要的 | 该复刻什么 | 推荐模式 |
|---|---|---|
| 那种画面感、色调、氛围 | 视觉风格 | 快速分析即可 |
| 那个镜头的运动方式 | 运镜参数 | 精确分析 |
| 整条片子的节奏和镜头结构 | 镜头顺序与时长分布 | 快速分析即可 |
| 逐镜头完整还原 | 全部字段 | 精确分析 |
| 结构照搬但主体换成自己的产品 | 结构保留、内容替换 | 快速分析即可 |
想清楚这一点能省不少点数。只要整体风格的话,一次 6 点的快速分析就够了,不必逐场景付费。
四步完整路径
第一步:反推,把视频变成提示词
打开 PromptHub 视频反推页面,粘贴视频链接或上传本地文件。
选快速分析(6 点固定)会得到两部分内容:全局参数(视觉风格、技术规格)适用于整条视频;镜头列表按顺序给出每个镜头的景别、时长、画面细节、运镜方式、主体运动和台词。
选精确分析(每场景 2 点)会先在浏览器里把视频切成场景,你确认切片点后逐场景分析,每个场景额外得到画面提示词、负向提示词、九项结构化运镜字段和全局锚点。
不确定素材值不值得深入时,先花 6 点做快速分析看看整体,再决定要不要精确分析。
第二步:用画面提示词出首帧
拿画面类字段去图像生成平台,生成每个镜头的第一帧。
快速分析取 visual_details 加 camera_setup,再附加全局参数里的 visual_style。精确分析直接取 image_prompt,另有 negative_prompt 可填入负向输入框。
这一步的目的是先把静态画面调对。首帧不满意就不要往下走,因为动态镜头是在首帧基础上生成的。
第三步:用视频提示词让画面动起来
拿运动类字段去视频生成平台,以第一步的首帧作为参考图做图生视频。
快速分析取 camera_movement 加 subject_motion。精确分析直接取 video_prompt_for_generation——这一条已经把九项运镜字段整合成完整文本,可以直接用,不需要自己拼装。
第四步:多镜头时锁住一致性
如果只做一个镜头,到第三步就结束了。做多个镜头就会遇到一致性问题:分开生成的镜头里,同一个人可能长相、发型、服装都不一样。
精确分析的输出里有两个字段专门解决这个:character_anchor(角色锚点)和 environment_anchor(环境锚点)。正确用法是把这两段文本追加到每一个镜头的提示词末尾,而不是只加在第一个镜头上。
快速分析不提供这两个字段,所以多镜头连续创作应该用精确分析。
一个完整的真实例子
目标:参考一条 28 秒的产品广告,做一组风格接近的三镜头短片。
第一步:反推。 先花 6 点做快速分析,拿到整体视觉风格"高对比度现代数字写实风格,强烈顶光",确认调性符合预期,镜头列表显示原片有 5 个镜头。
判断需要逐镜头生成,于是切到精确分析。上传同一素材,切片检测出 5 个场景(免费),检查发现第 3 个场景只有 1.6 秒、低于 2 秒下限,在时间轴上把它与相邻场景合并(免费),变成 4 个场景。选择其中 3 个关键场景分析,消耗 6 点。
拿到三个场景的完整字段,包括各自的 image_prompt、negative_prompt、九项运镜字段,以及全局锚点:
character_anchor:黑色连帽衫、短发的年轻男性
environment_anchor:幽蓝色调的昏暗机房,多屏幕环境
第二步:出首帧。 用三条 image_prompt 分别生成首帧,每条都在末尾附加两个锚点。第二个镜头的首帧生成了两次才满意。
第三步:出动态。 用三条 video_prompt_for_generation 配合对应首帧做图生视频,同样附加锚点。
第四步:检查一致性。 三个镜头里的人物服装和场景色调基本一致。
反推总成本:12 点(快速分析 6 点 + 三个场景 6 点)。图像与视频生成的费用按所用生成能力另计。
如果跳过第一步的快速分析,直接精确分析三个场景,反推成本是 6 点。多花的那 6 点买到的是"先验证方向再投入"——素材不合适时可以及早止损。
能复刻到什么程度
如实说明,避免预期错位:
可以做到的:
- 镜头语言接近:景别、机位角度、运镜方式和速度可以复现得比较准。
- 视觉风格接近:色调、光线质感、画面材质的描述足够具体,生成结果的调性会比较像。
- 结构一致:镜头顺序、每个镜头的时长和节奏可以照搬。
做不到的:
- 逐帧相同。 不同平台的模型、随机种子和参数都不同,即使描述准确也只是风格接近。
- 还原原始提示词。 反推描述的是成品画面,成品视频里不包含生成它的指令。即使原视频根本不是 AI 生成的,反推同样可以进行。
- 完全一致的人物。 全局锚点能明显降低漂移概率,但不同平台的一致性能力差异较大。
- 画面里没有的信息。 拍得看不清的内容,反推也写不出来。
常见失败原因和解决方法
生成结果和原视频差别很大。
先确认字段类别用对了:图像平台要用画面类字段,视频平台要用运动类字段,混用会让平台忽略大量内容。其次检查提示词是否因过长被平台截断,裁剪顺序是先保留主体与动作、再保留景别与运镜、风格描述按需保留。
多个镜头的人物不一致。
确认锚点附加到了每个镜头,而不是只加在第一个。若平台一致性能力有限,改用图生视频、以第一个镜头的成品帧作为后续镜头的参考图。
精确分析提示场景时长不足或过长。
每个场景必须在 2 到 30 秒之间。短于 2 秒时与相邻场景合并,长于 30 秒时增加切片点拆开。调整切片点不消耗点数。
参考视频是 YouTube 链接,精确分析用不了。
精确分析不支持 YouTube。改用快速分析直接提交链接,或把视频保存为本地文件后上传,此时适用 100MB 上限。
上传时提示文件过大。
快速分析上限 70MB,精确分析上限 100MB。截取需要的片段,或转码到 720p 后重试。
反推失败了。
失败会自动退还预扣的点数。若提示"视频文件无效或无法读取",转换为 MP4(H.264)后重试。
有哪些限制
- 复刻的是镜头语言与视觉风格,不是逐帧相同的画面。
- 精确分析不支持 YouTube 链接,且每个场景时长必须在 2 到 30 秒之间。
- 快速分析不提供负向提示词和全局锚点,多镜头一致性需求必须用精确分析。
- 反推输出为通用结构化文本,不针对特定平台做语法适配,跨平台使用需人工裁剪。
- 各生成平台的最终效果由对应平台决定,PromptHub 不对第三方结果作保证。
- 使用第三方平台视频作为参考需遵守对应平台的服务条款与版权规定。