先定位:原片就错,还是剪完才错

选一个画面和声音确实属于同一事件的时刻,例如近处门合上与对应的合门声,或镜头里说话者清楚的起音。不要拿另加的配乐重拍、远处声音传播或有意先行的画外声当作必须重合的锚点。先确认这版作品希望它怎样对应。

按原片、锁定剪后画面所对应的声音、混音候选、实际导出依次比较。记录文件版本、事件、画面时刻、声音时刻和原片来源;没有播放观察的值写未知。预览异常时再比较同一导出在另一个播放器的表现,避免只凭编辑器卡顿改动已经正确的文件。

原片也错时,要先处理素材或录音的对应关系。原片正确、剪后才错时,优先看选段和声音放置。画面与声音已经正确、只有字幕提前或延后时,转到字幕同步检查;AI生成的嘴部表演本身错了,见AI视频口型排查。

这是已有内容的定位工作,不需要先重写解说文案或重录所有声音。

比较几个位置,再决定修哪里

观察到的形状优先检查与修订范围
同一段的多个对应事件都晚相近幅度核对是否整段放晚、误用了旧时间。证据相符且完整声音能保留时,再修这段位置;只看一个动作还不够。
开始接近,后面逐渐偏开核对是否混用了不同版本、只有一层变速,或导入/渲染改变实际时钟。先找到差异,不靠一次平移修全片。
只在一处重剪之后突然错位查该剪点前后的原片起止和剪后位置,以及是否还在用旧底轨。后面已有正确的段落不要一起移动。
某一路正确,另一路错分别检查原对白、旁白、动作声和音乐的来源与放置;不能从一路错推出全部混音都晚。

这些是编辑诊断,不是自动识别结果。一次门声可能被遮盖或来自别处,不能只看波形峰值就认定它与画面动作同源。补看同一段的完整句子、下一动作和剪点后另一事件,直到修订范围有依据。

完整原创范例:画面选了新入点,原声还用了旧入点

下面是虚构木工作坊视频的纸面记录,没有真实音视频测试。示例选定25fps恒定帧率、零起点且符合来源工具要求的素材;实际项目必须先核真实媒体。原片中,门在4.0秒合上并有对应声响,人物在5.0—6.2秒说完“钥匙留在桌上”。

剪后画面共10秒:先取原片1—7秒,放到成片0—6秒;再接另一段已选的4秒画面。出问题的候选把第一段原声误取成原片0—6秒,仍放在成片0—6秒。第二段声音、独立连续音乐与已采用旁白的位置正确。

项目本例记录与决定
第一段正确画面原片1—7秒映射到成片0—6秒;门应在成片3.0秒合上,台词应在4.0—5.2秒发生。
候选第一段声音误取原片0—6秒;门声在成片4.0秒,台词从5.0秒开始,原片6.0—6.2秒的句尾还被漏掉。
正确修订回原片完整取1—7秒声音,放回成片0—6秒,既修事件位置,也补回句尾;不是把已裁短的候选声音前移就结束。
后续已定内容第二段仍从成片6秒开始;保留它的正确声音、整条连续音乐和完整已采用旁白,不把这些一起前移1秒。
待实际验证新候选中门动作与门声的对应,完整句尾,6秒剪点交接、第二段及全片;纸面运算不能预填试听通过。

在这个25fps例子里,正确源范围是半开帧区间25—175;原片第100帧的门动作映射到成片第75帧,即3.0秒。48kHz输出上,这个时刻是零起点的样本位置144000。数字用于解释本例;实际帧率或时钟不同就从实际映射求值,不能照抄。

Video Recap 的原声/音乐底轨方法允许按明确原片帧区间和输出位置重新准备声音。此例只更换第一段来源区间,完整底轨计划仍要包括第二段和全部明确空白;音乐已有正确连续轨时,按已选轨保留。重新准备受影响的底轨与新混音放置记录,再使用现有完整声音合成路径出新候选。原文、WAV和声线未改时,不为移动或修原声而重跑TTS。

总时长10秒在错误候选里也成立,第一段却既错位又丢句尾。恢复正确来源后,正常速度核对门、整句、剪点和第二段,最后完整播放10秒成片;这个检查计划尚未实际执行。

选对工具:保留音轨不等于自动同步

方法能做什么与边界
画面与已定混音配对pair_media.py复制两路已选压缩流,核实际首尾与包时钟;不做偏移、变速、裁切或听感对齐。适合内部事件仍对应的新画面。
按原片区间重建声音底轨source_score.py消费明确的源帧范围与输出位置,准备原声和连续音乐;不自己猜对白、不自动修漂移,也不输出最终视频。
已采用旁白与底轨合成完整声音采用路径消费明确的放置与增益,保完整声音。新output_start_sample才决定这个路径的旁白位置,旧生成窗口不自动成为新剪后位置。

当前源底轨实现核恒定帧率和实际包时钟,不接受把可变帧率、变速或任意秒数偏移字段塞进去冒充支持。输入不适合时先回上游准备合适素材或在编辑器中完成明确修订,再核实际对应;不要随便补一个未支持的参数。

Adobe的同步说明把同步点分为入点、出点、共同时间码、标记等。使用编辑器同步功能也先确定哪一个点属于同一事件,再看整段,不把开始对齐当作所有后续都正确。

YouTube上传排障也单列音画不同步并提醒检查两轨时长。本地编辑仍要逐事件核对;时长一致是需要看的条件,不能替代内容对应。

修后检查新导出,不拿旧试听代替

回到这次实际导出,先播改动前、改动处和改动后的清楚事件,再连播整段与整片。除了动作与声音,还要听完整句尾、剪点处是否重说或漏说、音乐是否仍按已定方式接续,检查字幕绑定的是当前声音版本。

文件或流验证只说明检查到的机械关系。流复制证明保住了选定音轨;底轨回执说明用了哪些源区间;放置记录说明声音放在哪里。哪一次动作听起来同步,仍需播放这版成片。未检查的位置继续标待检查。

如果只是正常的声音先行、延后或跨镜头对白,保留已接受的叙事安排。需要让所有声音贴切点整齐排列,并不是音画同步的目标。

常见问题

声音整体往前挪一点就能修好吗?

只有已核对事件支持同幅度偏移、完整声音仍在且移动不损坏其他正确段落时,才按该范围修位置。持续漂移、错源片段或被裁掉句尾需要另外处理;本例回源重取声音才同时修好了位置和完整性。

字幕对上了,音画就一定同步吗?

不一定。字幕可以跟着一条已经放错的声音显示。分别核字幕与声音、声音与对应动作的关系,再在新成片里播放;不要靠移动字幕掩盖声音层错位。

用 skill 来做

在已安装 Video Recap 的宿主中,用 $video-recap 只分析这版成片的音画错位。我提供原片/剪后画面/混音/导出版本、真实源到输出映射及已播放的对应事件记录。定位第一个出现问题的阶段和最小有依据的修订范围,未知时间保持未知;保已定文字、完整WAV、声线和未受影响的声音,列回源范围及新放置需核的项目。本轮不重录、不渲染,不宣称已听审。

查看具体方法: 原片帧范围与输出声音底轨 · 完整采用声音与明确放置 · 重剪后采用声音的阶段衔接 · 流复制与感知同步的区别

了解 Video Recap Skills在 GitHub 查看 video-recap

全部指南