第 40 章 声音选角和 Voice Bible

第八部 配音、旁白、音乐与声音设计

第 40 章 声音选角和 Voice Bible#

本章目录
40.1 声音也是角色资产40.2 角色间先可区分40.3 Voice Card40.4 试音场景40.5 声音黄金样本40.6 参数与版本40.7 发音词典40.8 权利与替代40.9 Voice QC40.10 把声音身份拆成稳定层和状态层40.11 联合选角矩阵40.12 回归台词与漂移阈值40.13 《逆光收购》的三女声设计40.14 声音选角 SOP40.15 故障树40.16 检查表、练习与交付物40.17 声音身份合同40.18 试音必须测试关系,而不只测试独白40.19 声音回归集与替代预案研究依据说明

40.1 声音也是角色资产#

人物跨集声音变化,会像换脸一样破坏身份。Voice Bible 不只保存“女声、成熟”,还记录音色、音域、语速、口音、气息、发音、情绪上限、生成参数、授权和禁用项。

40.2 角色间先可区分#

主要角色在手机小音箱上也应可辨。不要让林筠、林薇和旁白都使用中低音、慢语速的“高级女声”。差异可来自共鸣位置、句尾、节奏、气息和情绪控制,而非夸张口音。

40.3 Voice Card#

voice:
  id: VO_LINYUN_01
  owner: CH_LINYUN
  age_read: 27-32
  timbre: 中性偏低,清晰但不厚重
  resonance: 前置适中
  pace: 4.2-4.8字/秒,压力下略慢
  articulation: 专业词清楚,句尾下落
  breath: 克制,少明显叹气
  emotional_ceiling: 4_of_5
  pressure_shift: 音量不提高,停顿缩短
  forbidden: [甜美撒娇, 播音腔, 持续气声]
  voice_engine: provider_voice_id
  parameter_version: 3
  rights: commercial_project_worldwide_3y

速度只是起点,具体台词仍需表演。

40.4 试音场景#

每个角色用同一组测试:中性说明、短命令、低声威胁、快速反驳、情绪压制、哭腔、喊叫、人名、金额、英文缩写和打断。只试听温和一句,会在高潮暴露音色崩坏。

将候选放入真实场景与音乐床,不单独听“好听”。

40.5 声音黄金样本#

批准后保存干声黄金样本:中性、压力、亲密、愤怒和疲惫。后续生成与其比较音高、速度、音色和发音。极端情绪样本不作所有台词的默认参考。

40.6 参数与版本#

固定 voice ID 不保证服务更新后完全相同。记录模型、版本、稳定度、风格强度、速度、音高和后处理。更换版本先跑回归台词。

跨集不能在不同电脑上凭耳朵重新调到“差不多”。

40.7 发音词典#

姓名、多音字、公司名、金额、日期和英文统一。词典记录文本、拼音/音素、读法示例、适用角色和版本。

同一角色“林筠”第一集和第十集读音不同,会比轻微音色变化更明显。

40.8 权利与替代#

确认真人声源同意、合成使用范围、期限、地区和衍生版本。未经许可不得克隆真实演员或公众人物。为关键角色准备替代路线和重新配音成本。

40.9 Voice QC#

比较身份、年龄、语速、发音、噪声、情绪和手机可辨。音频相似度可提示音高漂移,不能判断表演是否正确。

40.10 把声音身份拆成稳定层和状态层#

稳定层包括基础音色、年龄感、共鸣位置、口音范围、咬字习惯和常态音域;状态层包括疲惫、受伤、饮酒、哭后、电话滤波、距离、秘密低语和公开演讲。项目不能因为角色生病就换一个声音,也不能为了保持一致而让角色在所有状态下完全相同。

每个状态都从批准声音派生,并写明可变化范围。例如哭后可以增加鼻音和断裂呼吸,但不能突然升高年龄感;电话状态改变频谱和空间,不能改变语速习惯;身份伪装可以改变礼貌程度和句尾,却仍保留某个不易察觉的辅音特征,供后续揭示使用。

40.11 联合选角矩阵#

选角时把主要人物两两放入同一段冲突,不只单独打分。矩阵检查音高区、语速、共鸣、气息、句尾、语言密度和情绪方式是否重叠。若林筠和林薇基础音域接近,可以让林筠句尾下落、停顿由思考产生,林薇句尾保持、停顿用于迫使别人等待;两人不需要靠夸张高低音区分。

旁白也要进入矩阵。全知旁白若与主角内心声相似,观众会误判叙述权限。系统应明确旁白是角色本人、未来的角色、第三方观察者还是平台式讲述者,并据此决定是否与角色声音共享身份。

40.12 回归台词与漂移阈值#

为每个核心角色保存 8–12 条回归台词,覆盖中性、快速、低声、专名、数字、压制情绪和高强度。任何模型、voice ID、参数或后处理变化都重新生成,与黄金样本做盲听。评审至少包括“是否仍像同一人”“角色关系是否改变”“极端状态是否可用”。

轻微音高差可以在后处理中匹配,骨相般的音色变化、辅音习惯变化和年龄感变化不能靠 EQ 修复。回归结果分为通过、限定通过和阻断;限定通过必须写明只允许哪些场景,不能把“普通对白可用”扩展成“哭喊也可用”。

40.13 《逆光收购》的三女声设计#

林筠、林薇和周岚都需要克制与权力感,若只搜索“高级女性声音”会高度同质。最终设计不靠简单音高:林筠语言短、专业名词咬字准确,压力越大音量越低;林薇语速略快,善用半句停顿观察旁人,公开场合句尾不落;周岚说话最慢,很少填充词,允许沉默迫使别人先解释。

三人同场测试时,团队关闭画面也能判断谁在控制局面。母亲谜案中的匿名电话则暂时改变频谱和距离,但保留周岚特有的长停顿,形成可回看的声音线索。

40.14 声音选角 SOP#

第一步,从人物逻辑提取声音行为。第二步,联合设计角色差异。第三步,用统一试音场景测试。第四步,在实际混音环境选择。第五步,建立 Voice Card、黄金样本和发音词典。第六步,记录参数与授权。第七步,用回归台词监测版本。

40.15 故障树#

**症状:角色单独好听,放一起分不清。**未联合选角。比较同场对话和手机外放。

**症状:高潮突然换声。**候选未测试情绪上限。重做极端场景试音。

**症状:跨集音色漂移。**参数、模型版本或后处理未记录。恢复批准链并做回归。

**症状:名字总读错。**没有项目发音词典。集中维护,禁止逐句手改。

40.16 检查表、练习与交付物#

检查主要角色是否可辨;试音是否覆盖情绪范围;参数和版本是否记录;黄金样本是否有多状态;发音词典是否统一;权利是否明确;版本更新是否回归。

练习一:为三名女性角色设计不同语言和声音算法。练习二:制作十句标准试音文本。练习三:建立二十个专名发音词典。

本章交付物:Voice Bible、Voice Card、Audition Matrix、Golden Voice Samples、Pronunciation Dictionary、Rights Record、Voice Regression Set。

40.17 声音身份合同#

Voice Card 应进一步升级为 Voice Identity Contract,明确哪些特征构成“这个角色的声音”,哪些可随剧情变化。稳定层包括大致音高重心、共振位置、语速习惯、咬字清晰度、气息比例、年龄感和口音边界;状态层包括疲劳、哭后鼻音、压低音量、公开演讲与私人耳语。稳定层无剧情原因不能跳变,状态层必须由事件触发。

voice_identity_contract:
  character: CH_LINYUN
  stable:
    pitch_center: medium_low_female
    resonance: forward_but_not_bright
    pace: 4.2_to_4.8_chars_per_second
    articulation: precise_endings
    age_read: late_20s_to_early_30s
  variable:
    public_control: reduced_breath_and_longer_phrases
    private_fear: shorter_phrases_and_audible_inhale
    post_cry: light_nasal_resonance
  forbidden:
    - 播音腔
    - 无触发的稚嫩化
    - 每句固定上扬

合同不要求每句声学参数完全相同。真正一致的是观众仍能在不同情绪中认出同一人,并相信变化来自经历。回归审核同时比较稳定层和状态合理性,不能把所有自然表演变化都判成漂移。

40.18 试音必须测试关系,而不只测试独白#

角色试音除中性陈述、低声秘密、愤怒和哭戏外,还要加入双人或三人关系测试。同一句“你再说一遍”面对上司、妹妹和仇人时,地位、距离和攻击方式不同。声音候选若只能单独听起来好,却无法与其他角色形成对比,就不适合整季。

联合选角时把主要角色放在同一音量和处理条件下盲听,检查音高区域、语速、齿音、口音和表演能量是否过于接近。不要靠后期 EQ 强行区分本来相似的声音;基础音色和节奏差异应在选角阶段完成。

试音还应使用项目真实难点:人名、公司名、数字、法律术语、快速打断、低声关键词和长旁白。候选在一句情绪台词上惊艳,却频繁读错核心名词或长段落容易塌气,生产成本会非常高。

40.19 声音回归集与替代预案#

每名角色保存 8–15 条回归句,覆盖中性、强情绪、低音量、快速、长句、专有名词和与其他角色的重叠。更换模型、参数、录音环境或声音演员时,用同一回归集比较身份、清晰度、表演范围和后期可处理性。

商业项目必须预先定义替代路线:原声音不可用时,是重新选角重配全季、只替换未发布集,还是使用已授权的声音模型延续。合同要说明训练、克隆、衍生、多语言和撤回条件;技术可行不等于权利允许。

替换后不能只比较新旧声纹。要把新声音放入对白、音乐和手机环境中测试,并评估已建立的角色关系是否改变。声音更明亮可能让原本克制的林筠显得年轻,进而影响人物可信度。替代是角色重选,不是文件格式替换。

研究依据说明#

AI 漫剧常把音色选择留到剪辑软件最后一步。本章将声音提升为跨集身份资产,后续对白、旁白和混音均引用它。