先用两列表判断“现在绑定”还是“暂不绑定”
| 检查项 | 绑定决定 |
|---|---|
| 声音是否已选定 | 已试听并接受、路径已登记:继续;仍是“待选型”或只有形容词:暂不绑定 |
| 文件是否真实可读 | 项目相对路径能打开:继续;只有文件名、说明文字或外部记忆:暂不绑定 |
| 目标是否接收参考音频 | 当前目标能力档案明确接收:继续;能力未确认或不接收:保留声音记录,不写绑定 |
| 本镜谁实际说话 | 只给剧本名下实际发声的人绑定;静默听者和仅出现在画面中的人物不绑定 |
| 这条参考承担什么 | 本例只承担音色;口音、语速或年龄若另有独立参考,应各自写成单独绑定 |
| 哪些内容必须排除 | 样本台词、语气、情绪、语速、停顿、录音空间、背景声与其他说话人 |
| 当前台词从哪里来 | 逐字取当前剧本;同一句由多人说过时,在提示词中点明本镜说话人 |
这一步发生在声音选型之后。想要“沉稳、年轻、沙哑”的文字说明不能充当音频参考,未选中的候选也不能先绑到镜头再决定。先完成试听、授权范围和项目登记,再把选中的真实路径带到视频提示词。
照抄路径,图片与音频分别编号
视频提示词保留项目原生字段顺序:镜头的“输入参考图”之后,增加一行“参考音频”。图片顺序从一开始计数,音频也独立从一开始计数;三张图片之后的第一条音频仍然是 音频1。参考路径逐字照抄角色在角色视觉设定文档里的已登记声音参考,避免同一角色在不同镜头悄悄换文件。
| 原生字段 | 本例填写值 |
|---|---|
| 输入参考图 | - 输入参考图:REF-XC(顺序:1)· 输入/角色/许澄-工作服.png《许澄工作服》;REF-LX(顺序:2)· 输入/角色/罗弦-工作服.png《罗弦工作服》;REF-ROOM(顺序:3)· 输入/地点/修表间.png《修表间》 |
| 参考音频 | - 参考音频:REF-VOICE-XC(顺序:1)· 输入/声音参考/许澄-音色-v3.wav《许澄已选音色》(用途:音色;角色:许澄;控制:音色质感、共鸣、年龄与体量印象;不得控制:台词、语气、情绪、语速、停顿、录音空间、背景声、其他说话人) |
| 当前说话人 | 许澄;本镜只有他发声 |
| 当前逐字台词 | 先把旧标签留在盒里,明早一起核对。 |
| 静默听者 | 罗弦;只承担看向旧标签后的反应,不绑定声音参考 |
字段里的“顺序:1”表示它是第一条音频输入,与图片的三个槽位没有合并计数。音频没有塞进“输入参考图”,分镜也不新增这条绑定;它属于本镜的视频提示词。
原创完整案例:修表间里留下旧标签
下面的《明早核对》是本文原创纸面镜头,没有真实音频上传、视频生成、口型检查或回听结果。许澄经营一间修表铺,罗弦是刚能独立接单的学徒。当天罗弦修好一只无主旧表,想把盒内褪色标签扔掉,让交付看起来整洁。许澄知道旧标签可能帮助第二天来店的老人确认物件来源,也看见罗弦担心自己留下杂物会被责备。
教学记录把 输入/声音参考/许澄-音色-v3.wav 设为已经选定的占位路径,设定的试音内容是“雾港的钟声过了三遍”,录音里说得轻快,并带有试音间混响。它只为许澄提供音色。试音文字、轻快语气、情绪、说话速度、停顿与房间混响都不能进入当前镜头。当前剧本让许澄看着标签,用平稳而清楚的本场表达说:“先把旧标签留在盒里,明早一起核对。”罗弦全程不说话;她先捏着标签一角,听完后把标签平放回盒中。
| 镜头要素 | 当前已定内容 |
|---|---|
| 起点 | 修表间工作台;旧表在打开的木盒里;罗弦捏着褪色标签一角;许澄站在桌侧看向标签 |
| 画面参考 | 图片一固定许澄身份与工作服;图片二固定罗弦身份与工作服;图片三固定工作台、木盒、台灯和后墙工具位置 |
| 唯一动作 | 许澄说完当前原句后,罗弦把标签平放回木盒;她没有台词 |
| 声音 | 只有许澄说当前剧本原句;底声为已经选定的轻微钟表走针声;没有试音文字、试音间混响或额外人声 |
| 终点 | 标签平放在旧表旁;罗弦手指离开标签并看向许澄;许澄仍在桌侧 |
| 声音绑定 | 音频1 只绑定许澄的音色;罗弦作为静默听者不绑定 |
下列正文假定当前目标能力档案已经确认用 音频1 指代第一条参考音频。这是项目已确认的输入记号,没有指向某个未核实的供应商格式:
修表间工作台保持图片三的空间,许澄保持图片一的身份与工作服,罗弦保持图片二的身份与工作服。许澄站在桌侧看向罗弦手里的旧标签。音频1只提供许澄的音色质感、共鸣、年龄与体量印象。许澄用本场平稳、清楚的表达说:“先把旧标签留在盒里,明早一起核对。”逐字保持当前台词。罗弦全程不发声;她听完后把标签平放回木盒,手指离开标签,再看向许澄。轻微钟表走针声贯穿本镜。试音文字、试音语气、试音情绪、试音语速、试音停顿、录音空间、背景声和其他说话人都不进入本镜。终点是标签平放在旧表旁,两人位置与工作台道具保持连续。
这段绑定保留两个人的动机:罗弦想完成一份整洁交付,许澄选择让旧物证据多留一晚。镜头结果改变明早能核对的材料,也把“立即丢弃”改成“两人共同确认后再决定”。
让当前剧本掌握台词与表演
声音参考承担身份层:音色质感、共鸣、年龄与体量印象。当前剧本和本镜表演承担事件层:逐字台词、说话人、语气、情绪、重音、速度、停顿、音量与当下呼吸。把这两层分开后,同一角色可以在不同场景里保持可识别的声音,同时根据争执、安慰、隐瞒或日常工作改变表达。
样本里听见的每项内容都需要明确归属。选择音色不等于采用样本句子;样本语速顺耳也不自动成为角色永久速度;样本带房间声时,文字排除项不会清理文件本身。发现底噪、另一个说话人或授权范围有问题,应回到声音资产处理,清理、重录或更换已选参考,再更新登记路径。
同一句台词在来源场次里曾由多人说过时,在正文中点名当前说话人。画面里出现两个人时,不按可见人数绑定声音;按实际发声人数绑定。本例只有许澄发声,因此只有一条音频输入。罗弦的反应由可见动作负责,保持静默。
绑定完成后,工具做什么、还没有做什么?
用 $short-drama-video-prompts 可以写入并检查本镜绑定:路径是否照抄、角色是否真的在本镜发声、用途与排除项是否完整、音频顺序是否独立、当前原句是否只出现一次。它不会替创作者试听候选、托管音频、上传到目标服务、启动生成,也不会确认模型最终采用了指定音色。
提交前核对五件事:参考文件仍可读;登记角色与当前说话人一致;目标能力档案仍接收参考音频;本镜正文只出现当前剧本台词;静默人物没有多余绑定。生成以后再回听真实输出,比较角色识别度、当前台词、表演方向、附带噪声与其他人声,并另行检查口型。本文示例只有一份纸面绑定记录,因此没有把任何生成或回听结论写成事实。
常见问题
声音参考还没选定,可以先写路径占位吗?
保留“待选型”,不要伪造可绑定路径。完成试听、授权确认与项目登记后,再把真实路径复制到实际说话镜头。
两个人同时出现在画面里,都要绑定音色吗?
只绑定本镜实际发声的人。静默听者用表情、视线或动作承担反应,没有台词就不增加音频绑定。
用 skill 来做
用 $short-drama-video-prompts 把已选角色音色绑定到这个实际说话镜头。照抄角色视觉设定文档里的真实声音路径,在输入参考图后写独立编号的参考音频;用途只选音色,明确排除样本台词、语气、情绪、语速、停顿、录音空间、背景声和其他说话人。保留当前剧本逐字台词,只绑定实际发声角色,并检查记录后停止,不上传或生成。
查看具体方法: 视频提示词中的角色音频绑定字段 · 声音参考的载体、用途边界与登记方式