先找多出的声音出现在哪一层

先对原生成素材回听,再对剪辑后的成片回听。不要只看字幕:字幕没写出的语气词可能仍在音频里,自动转写也可能把正确原句识别错。

听到的问题先查哪里
原素材已有旁白或新台词生成提示词的完整声音时间线与本场已定声音。
角色先加“嗯、啊”才读原句发声是否要求从原文首字开始;这些非语言或语气发声是否本就允许。
同一句说两次单镜原句是否被重复抄进多个段落;相邻镜是否都从句首开始。
原素材正确,成片才多声音剪辑、旁白轨、重复音频片段与声音落点。

本页解决擅自新增的人声。语种错了另查语种与原句指南;正确声音配到错误嘴部,另查口型指南。不要因问题发生在成片,就一律重生成正确原素材。

写允许的声音,再写已确认的排除项

Drama Skills 的 motion-recipe 对同轨声音要求:列全本镜对白、旁白、画外声、必要非语言发声和音效,逐字原句只在单镜可复制正文中出现一次,事件外回到已定底声或静默。视觉段按时点引用声音事件,不再抄一遍原句。

每项人声至少回答:谁、从哪里、用什么语言、说哪一句、何时开始与结束。叹气、笑声、吸气与重叠说话只有本场确实选择时才加入;不是所有片段都要禁止它们。

同一镜前面写“无对白”,后面又安排人物说话,是相互矛盾的目标。只说“不要旁白”也没有交代应保住哪些对白或音效。末尾总结本镜实际层次,把作者已经确认不要的新增声音合并说明一次,不扩大成一套通用禁令。

完整示例一:保留店员的原句,不让模型加解说

原创纸面场景:打印店柜台,店员孟茹把一册样册交给顾言。她的画内普通话对白是“这本先给你核对。”顾言本镜不说话。已定声音只有连续低风扇声、这句对白,以及接册时的轻微纸张摩擦;作者已确认不要旁白、新台词、额外语气词、重复句或配乐。时长尚待按实际发声、交接与收尾核定,没有生成或回听结果。

下面是可按角色和场景事实接入的指令候选,没有假称已存在参考图或录音:

固定双人中景,孟茹在柜台后,顾言在柜台前,一册样册由孟茹持有。开头两人保持当前位置,连续低风扇声已经存在。

孟茹把样册放到柜台交接位置,顾言先等待。她完成放置后进行声音事件A:孟茹画内对白,实际说话语言为普通话,逐字说“这本先给你核对。”发声从这句首字开始,到末字结束。顾言在事件A期间听,不发声,嘴唇闭合;视觉段不重复这一句。

事件A结束后,顾言才接起样册,孟茹松手。保留接册所产生的轻微纸张摩擦声,风扇底声继续。结尾样册在顾言手中,孟茹双手已空,两人都不再发声。声音层只有本句画内对白、风扇底声和所述纸声;不加入旁白、新台词、额外语气词、重复句或配乐。

原句不是旁白,不用改成旁白来避开口型。末尾也不能再加一个“他终于拿到样册”的解说。交接完成不表示顾言已经核对内容;影片只到接册这一拍。

英文提示词正文也可以保留普通话原句;下面的译文仅供英文读者理解,不能当第二条要发声的台词加入生成指令。

完整示例二:另一已定无对白版本,仍保留环境与纸声

如果作者另选的剧本版本本就没有台词,同一交接也可以只有环境与动作声音。这是制作前明确采用的另一版本,不是修掉额外旁白时顺便删除原本要求的店员对白:

固定双人中景,起点仍是孟茹在柜台后持一册样册、顾言在柜台前等待。全镜只有连续低风扇底声和接册时的轻微纸张摩擦声。两人全程不发声,嘴唇闭合。

孟茹把样册放到交接位置,顾言随后接起,孟茹松手。纸声只跟这次实际接册发生;动作前后风扇底声继续,不补声音空缺。结尾样册在顾言手中、孟茹双手空着,保留这一状态。全镜无对白、旁白、画外说话、额外人声或配乐,保留已定风扇声与纸声。

“无对白”与“全片静音”不同。本例没有叹气或笑声;若你的剧本需要它们,明确由谁在哪一拍发出,不照抄本例的排除项。提示词语言、实际说话语言与字幕文字分别决定。

生成后回听,修改提示词不等于已经删掉声音

从头到尾回听这句有没有多出的开头、尾句、重复或换人,再看接册时有没有让顾言跟说。对照的是实际音频,不是字幕里看起来正确的原句。记录错误发生在原素材还是后期,再只改对应段落或声音轨。

若多余旁白和正确对白已经混在同一条音轨,直接静音会一起删掉它们。要采用重出、独立配音或后期处理,先确认实际工具能执行所需方案,处理后回听输出。套件剪辑工具的声音说明不会自动把文字要求变成静音、声音桥或替换音轨。

模型可能仍产生额外发声,文字约束不是成功证明。无新增声音之外,还要保留完整原句、正确说话者、必要音效与本场结尾;修复不能以丢失原要求为代价。

常见问题

写“不要旁白”就够了吗?

还要说明允许的对白、音效、底声与事件间状态。否则它没有交代应保住什么。按本场已定声音写完整时间线,生成后回听。

能不能把原视频静音解决?

只有作者确实选择不要原声音轨、并另有已确认的声音方案时才这样处理。若仍要保留同轨对白或音效,全部静音会删掉所需内容。

用 skill 来做

用 $short-drama-video-prompts 修本镜擅自新增发声的声音段。附本场剧本、逐字台词、说话人、声源、语种、已定底声/音效与实际多出的声音位置。要求原句单镜出现一次、事件外回归底声、只合并已确认排除项,视觉与终点保持;不得声称改提示词已经修好成片。

查看具体方法: 完整声音时间线与逐字原句 · 声音性质、说话人与跨镜连续 · 实际声音处理与回听

了解 Drama Skills在 GitHub 查看 short-drama-video-prompts

全部指南