先区分三路声音的工作
Video Recap 的合成方法把原声、旁白与配乐分开处理,创作决定先于参数。逐段写清这次观众必须听到什么;有意义的沉默也是内容,不是等着补音乐的空洞。
原创解说场景:人物先说“钥匙在你手里”,随后打开空柜,再看向对方。第一句让观众知道谁掌握物件,开柜声说明动作完成,短旁白补充此前为什么寻找柜中记录。若音乐持续高位,关键台词与动作都可能被盖住。
先听未加音乐的版本。原对白本身已经听不清时,回到所选声音流或源素材检查,不能把问题全部归给 BGM,更不能通过再加一层旁白猜原台词。
把局部声音取舍写下来
| 段落 | 判断与处理 |
|---|---|
| 关键对白 | 必须听清: 完整的钥匙句 音乐处理: 降低或暂时不铺 原声处理: 保留句首与句末 |
| 开空柜 | 必须听清: 开柜声与停顿 音乐处理: 根据情绪低位延续或留空 原声处理: 保留有用动作声 |
| 补背景 | 必须听清: 连续旁白 音乐处理: 在旁白下保持较低位置 原声处理: 压低非关键原声 |
| 对方回应 | 必须听清: 回答与犹豫 音乐处理: 不在回答中突然跃升 原声处理: 到可靠停顿再恢复 |
表格是本例的创作选择,不是全片固定比例。不要要求旁白覆盖七成,或者音乐永远比人声低同一个数;不同素材、声线与音乐频段需要实际试听。
完整八秒例子:保住钥匙句和空柜后的回应
沿用上面的原创钥匙与空柜场景,把“该听见什么”写到完整声音交接。这里的秒数是为例子选定的纸面窗口,实际素材中的发声、动作与停顿仍要重测;若完整句放不下,应改窗口,不剪掉尾字。
| 成片时间 | 声音与配乐决定 |
|---|---|
| 0—1.5秒 | 保留甲的完整原对白“钥匙在你手里。”;不加独立BGM,旁白不抢这句 |
| 1.5—3秒 | 乙把钥匙交给甲,甲接过并开柜,柜内为空;保留开柜声与停顿,不用音乐重音假装发现了另一个人 |
| 3—6秒 | 旁白“他们来找昨晚的值班记录。”;只补本例已确定的来意,压低非关键背景,仍不加BGM |
| 6—8秒 | 甲转头看乙,乙回应“我没拿走。”;留完整发声与犹豫,不提前用旁白解释是谁拿走记录 |
本候选选择八秒都不额外铺音乐,先恢复人声与停顿的作用,并不要求所有视频无配乐。乙说没拿走是他的否认,不等于已证明清白;空柜也不能证明记录从未放过这里。
在普通入口中,取消独立配乐只会移除额外BGM。如果原素材本身已经把音乐和台词混在同一轨,改 BGM_VOLUME 不会单独压低那段素材里的音乐;先找可用干净声音或另行修订实际底轨,不写成原台词已经救回。
若走原片区间重建底轨的方法,要为这些窗口选出对应真实区间。source_score.py 只生成原声、音乐及合成底轨和回执;没有另外加音乐的决定可用严格 score:{"kind":"none"},之后再按完整声音路径加入已采用旁白。它不是一运行就得到最终视频,也不自动替你决定对白。
以后要局部压低音乐,引用版本的 raw 配乐是一个连续播放头与全轨增益、首尾渐变,不能假称它按上表自动逐段duck。可以另行完成所需音乐轨、核实际长度与声音,再作为 frozen 轨采用;已经做好的增益和渐变不能重复加工。最后回听完整八秒,本文没有实际生成或听审这段候选。
先确认使用哪条合成路径
在本文引用版本的普通合成入口,BGM_PATH 指定配乐,BGM_VOLUME 与 BGM_DUCKING_VOLUME 控制音乐位置;原声另有闲时与旁白下的音量设置。先改冲突的那一路,输出短候选试听,不拿整体响度标准化代替局部平衡。
如果已采用完整声音底轨,严格混音路径会跳过旧 BGM、ducking 和标准化设置。此时不能以为修改环境参数就改了音乐,更不能把已混好的底轨再次放进旧入口自动压低。应回到声音底轨的原声区间与音乐决定,局部修订再重新采用。
参数只控制实现,不能证明听起来清楚。不要为凑一个目标响度裁掉必需的配音尾字。
局部音乐比例修好之后,再做所需整片响度处理并测量当前编码输出的实际LUFS和真峰。短剧声音方法指出,两遍 loudnorm 也不能保证恰好命中目标;目标值不是实测值。整片达标仍要逐句听,不能从平均响度推断钥匙句清楚。
如果旁白在未加音乐时就一段响一段轻,应回分段配音检查;TTS的RMS归一记录描述该WAV阶段,不自动代表混音后的响度。先区分这两个问题,避免给每段一起加增益后又让音乐盖住原对白。
只听声音复核完整交接
依次听关键台词、旁白起止、音乐进入与原声恢复。检查是否有半句突然变响,音乐是否在叙事没变化时重启,旁白是否和必需原对白同时争抢注意力。
若仍听不清,先试减少音乐或取消这一段配乐;若冲突来自两路人声,改旁白位置或缩短文案,而不是只压音乐。手机扬声器与耳机都可作实际检查,纸面数值和自动报告不能代替听审。
最后正常速度看全段,确认声音让人物选择与结果更清楚。没实际试听过的方案应当叫候选,不写成“人声已完美突出”。
常见问题
把成片总音量调小能解决吗?
通常不能,音乐与人声会一起变小,比例仍然相同。回到独立轨道调整冲突,必要时改声音分工或旁白位置。
用 skill 来做
请通过 video-recap 检查这段解说,标出必需原对白、旁白与音乐的职责,再交 video-assemble 调整对应路径;先给短候选试听。
查看具体方法: 合成声音分工与音乐参数 · 音频模式与处理边界 · 混音后的响度与逐句听审 · 原片区间、无额外配乐与冻结音乐轨 · 底轨与已采用旁白的完整声音路径