Video Use 把剪辑建立在逐词转写和确认策略上
在 PromptHub 的 Skill 目录里,Video Use 是一个通过对话剪辑视频的 Skill。它可以处理 talking head、montage、教程、旅行、采访等素材,支持转写、剪切、调色、叠加动画和烧录字幕。
Video Use 把剪辑建立在逐词转写和确认策略上
Video Use 是什么
在 PromptHub 的 Skill 目录里,Video Use 是一个通过对话剪辑视频的 Skill。它可以处理 talking head、montage、教程、旅行、采访等素材,支持转写、剪切、调色、叠加动画和烧录字幕。
它的核心态度很有意思:没有固定菜单,先看素材,再问用户,再确认策略,最后执行和迭代。
它把音频放在第一位
Video Use 的剪辑逻辑从 raw transcript 和 phrase-level transcript 开始。它认为音频是主要线索,视觉跟随音频。剪点先来自词边界和静音间隙,只有在关键决策点才深入看画面。
这对口播和访谈尤其重要。很多剪辑问题不是画面不漂亮,而是切进词中间、字幕漂移、语气被截断,观众会立刻觉得不顺。
它有硬性的生产正确性规则
源文件列了很多 hard rules:字幕必须放在滤镜链最后,避免被 overlay 盖住;每段先 lossless extract 再 concat,避免重复编码;每个切点做 30ms audio fade,避免爆音;绝不在词中间切;SRT 要用输出时间轴偏移。
这些规则不浪漫,但非常实战。它们解决的是“看起来能跑,其实成片有暗病”的问题。
一个具体示例
假设你有 8 条课程口播 take,要剪成一条 90 秒小红书视频。Video Use 会先批量转写并生成 takes_packed.md,用时间戳短语找到表达清楚的段落。
它会先用中文描述剪辑策略:保留哪条主线,删掉哪些口误,字幕走什么风格,是否加重点词动画。用户确认后,才生成 EDL、抽取片段、叠加动画、烧字幕和导出 preview。
适合什么场景
它适合口播视频、采访、多 take 选段、教程剪辑、旅行素材整理和需要字幕与动画叠加的成片。
如果用户要从零生成视频素材,它不是主要工具;它更适合已有视频素材的后期整理。
使用边界与失败排查
如果字幕和画面错位,先检查 master SRT 是否使用输出时间轴,而不是源素材时间轴。
如果切点有爆音,检查每段边界是否加了 30ms fade。这个问题很小,但很伤成片质感。
更多说明可以看 Video Use 的 PromptHub 页面 和 GitHub 原始 Skill 文件。
结论
Video Use 的价值,是把“对话式剪辑”落到可验证的音频、字幕、EDL 和 ffmpeg 流程里。
它适合把已有素材剪成干净、可发布的视频,而不是只给剪辑建议。