第八部 配音、旁白、音乐与声音设计
第 40 章 声音选角和 Voice Bible#
本章目录
40.1 声音也是角色资产#
人物跨集声音变化,会像换脸一样破坏身份。Voice Bible 不只保存“女声、成熟”,还记录音色、音域、语速、口音、气息、发音、情绪上限、生成参数、授权和禁用项。
40.2 角色间先可区分#
主要角色在手机小音箱上也应可辨。不要让林筠、林薇和旁白都使用中低音、慢语速的“高级女声”。差异可来自共鸣位置、句尾、节奏、气息和情绪控制,而非夸张口音。
40.3 Voice Card#
voice:
id: VO_LINYUN_01
owner: CH_LINYUN
age_read: 27-32
timbre: 中性偏低,清晰但不厚重
resonance: 前置适中
pace: 4.2-4.8字/秒,压力下略慢
articulation: 专业词清楚,句尾下落
breath: 克制,少明显叹气
emotional_ceiling: 4_of_5
pressure_shift: 音量不提高,停顿缩短
forbidden: [甜美撒娇, 播音腔, 持续气声]
voice_engine: provider_voice_id
parameter_version: 3
rights: commercial_project_worldwide_3y
速度只是起点,具体台词仍需表演。
40.4 试音场景#
每个角色用同一组测试:中性说明、短命令、低声威胁、快速反驳、情绪压制、哭腔、喊叫、人名、金额、英文缩写和打断。只试听温和一句,会在高潮暴露音色崩坏。
将候选放入真实场景与音乐床,不单独听“好听”。
40.5 声音黄金样本#
批准后保存干声黄金样本:中性、压力、亲密、愤怒和疲惫。后续生成与其比较音高、速度、音色和发音。极端情绪样本不作所有台词的默认参考。
40.6 参数与版本#
固定 voice ID 不保证服务更新后完全相同。记录模型、版本、稳定度、风格强度、速度、音高和后处理。更换版本先跑回归台词。
跨集不能在不同电脑上凭耳朵重新调到“差不多”。
40.7 发音词典#
姓名、多音字、公司名、金额、日期和英文统一。词典记录文本、拼音/音素、读法示例、适用角色和版本。
同一角色“林筠”第一集和第十集读音不同,会比轻微音色变化更明显。
40.8 权利与替代#
确认真人声源同意、合成使用范围、期限、地区和衍生版本。未经许可不得克隆真实演员或公众人物。为关键角色准备替代路线和重新配音成本。
40.9 Voice QC#
比较身份、年龄、语速、发音、噪声、情绪和手机可辨。音频相似度可提示音高漂移,不能判断表演是否正确。
40.10 把声音身份拆成稳定层和状态层#
稳定层包括基础音色、年龄感、共鸣位置、口音范围、咬字习惯和常态音域;状态层包括疲惫、受伤、饮酒、哭后、电话滤波、距离、秘密低语和公开演讲。项目不能因为角色生病就换一个声音,也不能为了保持一致而让角色在所有状态下完全相同。
每个状态都从批准声音派生,并写明可变化范围。例如哭后可以增加鼻音和断裂呼吸,但不能突然升高年龄感;电话状态改变频谱和空间,不能改变语速习惯;身份伪装可以改变礼貌程度和句尾,却仍保留某个不易察觉的辅音特征,供后续揭示使用。
40.11 联合选角矩阵#
选角时把主要人物两两放入同一段冲突,不只单独打分。矩阵检查音高区、语速、共鸣、气息、句尾、语言密度和情绪方式是否重叠。若林筠和林薇基础音域接近,可以让林筠句尾下落、停顿由思考产生,林薇句尾保持、停顿用于迫使别人等待;两人不需要靠夸张高低音区分。
旁白也要进入矩阵。全知旁白若与主角内心声相似,观众会误判叙述权限。系统应明确旁白是角色本人、未来的角色、第三方观察者还是平台式讲述者,并据此决定是否与角色声音共享身份。
40.12 回归台词与漂移阈值#
为每个核心角色保存 8–12 条回归台词,覆盖中性、快速、低声、专名、数字、压制情绪和高强度。任何模型、voice ID、参数或后处理变化都重新生成,与黄金样本做盲听。评审至少包括“是否仍像同一人”“角色关系是否改变”“极端状态是否可用”。
轻微音高差可以在后处理中匹配,骨相般的音色变化、辅音习惯变化和年龄感变化不能靠 EQ 修复。回归结果分为通过、限定通过和阻断;限定通过必须写明只允许哪些场景,不能把“普通对白可用”扩展成“哭喊也可用”。
40.13 《逆光收购》的三女声设计#
林筠、林薇和周岚都需要克制与权力感,若只搜索“高级女性声音”会高度同质。最终设计不靠简单音高:林筠语言短、专业名词咬字准确,压力越大音量越低;林薇语速略快,善用半句停顿观察旁人,公开场合句尾不落;周岚说话最慢,很少填充词,允许沉默迫使别人先解释。
三人同场测试时,团队关闭画面也能判断谁在控制局面。母亲谜案中的匿名电话则暂时改变频谱和距离,但保留周岚特有的长停顿,形成可回看的声音线索。
40.14 声音选角 SOP#
第一步,从人物逻辑提取声音行为。第二步,联合设计角色差异。第三步,用统一试音场景测试。第四步,在实际混音环境选择。第五步,建立 Voice Card、黄金样本和发音词典。第六步,记录参数与授权。第七步,用回归台词监测版本。
40.15 故障树#
**症状:角色单独好听,放一起分不清。**未联合选角。比较同场对话和手机外放。
**症状:高潮突然换声。**候选未测试情绪上限。重做极端场景试音。
**症状:跨集音色漂移。**参数、模型版本或后处理未记录。恢复批准链并做回归。
**症状:名字总读错。**没有项目发音词典。集中维护,禁止逐句手改。
40.16 检查表、练习与交付物#
检查主要角色是否可辨;试音是否覆盖情绪范围;参数和版本是否记录;黄金样本是否有多状态;发音词典是否统一;权利是否明确;版本更新是否回归。
练习一:为三名女性角色设计不同语言和声音算法。练习二:制作十句标准试音文本。练习三:建立二十个专名发音词典。
本章交付物:Voice Bible、Voice Card、Audition Matrix、Golden Voice Samples、Pronunciation Dictionary、Rights Record、Voice Regression Set。
40.17 声音身份合同#
Voice Card 应进一步升级为 Voice Identity Contract,明确哪些特征构成“这个角色的声音”,哪些可随剧情变化。稳定层包括大致音高重心、共振位置、语速习惯、咬字清晰度、气息比例、年龄感和口音边界;状态层包括疲劳、哭后鼻音、压低音量、公开演讲与私人耳语。稳定层无剧情原因不能跳变,状态层必须由事件触发。
voice_identity_contract:
character: CH_LINYUN
stable:
pitch_center: medium_low_female
resonance: forward_but_not_bright
pace: 4.2_to_4.8_chars_per_second
articulation: precise_endings
age_read: late_20s_to_early_30s
variable:
public_control: reduced_breath_and_longer_phrases
private_fear: shorter_phrases_and_audible_inhale
post_cry: light_nasal_resonance
forbidden:
- 播音腔
- 无触发的稚嫩化
- 每句固定上扬
合同不要求每句声学参数完全相同。真正一致的是观众仍能在不同情绪中认出同一人,并相信变化来自经历。回归审核同时比较稳定层和状态合理性,不能把所有自然表演变化都判成漂移。
40.18 试音必须测试关系,而不只测试独白#
角色试音除中性陈述、低声秘密、愤怒和哭戏外,还要加入双人或三人关系测试。同一句“你再说一遍”面对上司、妹妹和仇人时,地位、距离和攻击方式不同。声音候选若只能单独听起来好,却无法与其他角色形成对比,就不适合整季。
联合选角时把主要角色放在同一音量和处理条件下盲听,检查音高区域、语速、齿音、口音和表演能量是否过于接近。不要靠后期 EQ 强行区分本来相似的声音;基础音色和节奏差异应在选角阶段完成。
试音还应使用项目真实难点:人名、公司名、数字、法律术语、快速打断、低声关键词和长旁白。候选在一句情绪台词上惊艳,却频繁读错核心名词或长段落容易塌气,生产成本会非常高。
40.19 声音回归集与替代预案#
每名角色保存 8–15 条回归句,覆盖中性、强情绪、低音量、快速、长句、专有名词和与其他角色的重叠。更换模型、参数、录音环境或声音演员时,用同一回归集比较身份、清晰度、表演范围和后期可处理性。
商业项目必须预先定义替代路线:原声音不可用时,是重新选角重配全季、只替换未发布集,还是使用已授权的声音模型延续。合同要说明训练、克隆、衍生、多语言和撤回条件;技术可行不等于权利允许。
替换后不能只比较新旧声纹。要把新声音放入对白、音乐和手机环境中测试,并评估已建立的角色关系是否改变。声音更明亮可能让原本克制的林筠显得年轻,进而影响人物可信度。替代是角色重选,不是文件格式替换。
研究依据说明#
AI 漫剧常把音色选择留到剪辑软件最后一步。本章将声音提升为跨集身份资产,后续对白、旁白和混音均引用它。