EQ 不是玄学,把人声频段拆开看,你就知道该推哪里该压哪里。
AI 生成的语音在频响上通常"够用但不完美"。默认输出往往中频偏厚、高频稍闷、低频偶尔带轰隆声。在监听耳机里听还行,放到手机外放或车载音响上就会暴露问题——声音糊、不够亮、或者有嗡嗡感。
EQ(均衡器)的作用就是把这些频段重新分配,让人声在目标播放设备上清晰可懂。这不是"锦上添花",而是保证内容可听性的基础步骤。
先认识人声各频段的声音特征和调整方向。
| 频段 | 范围 | 声音特征 | 调整效果 |
|---|---|---|---|
| 超低频 | 20-80Hz | 轰隆、闷雷感 | 切除,人声不需要 |
| 低频 | 80-200Hz | 厚度、温暖感 | 适度保留,过多会闷 |
| 中低频 | 200-500Hz | 鼻音、箱体感 | 容易堆积,常需衰减 |
| 中频 | 500Hz-2kHz | 人声主体、存在感 | 核心频段,谨慎调整 |
| 中高频 | 2k-5kHz | 清晰度、咬字 | 适度提升增加穿透力 |
| 高频 | 5k-10kHz | 明亮度、齿音 | 适度提升,过多刺耳 |
| 超高频 | 10k-20kHz | 空气感、细节 | 轻微提升增加开放感 |
第一个操作永远是用高通滤波器切除 80Hz 以下的频段。人声几乎不存在这个范围的声音,保留的只有空调嗡声、桌面震动等噪声。
设置:高通滤波器,频率 80Hz,坡度 12-24dB/oct。
200-500Hz 是人声最容易"堆积"的区域。AI 配音在这个范围常常偏多,导致声音"闷在盒子里"。
处理方式:在 300Hz 附近做一个宽 Q 值的衰减,幅度 -2 到 -4dB。不要切太多,否则声音会变薄。
500Hz-2kHz 是人声的"存在感"区域。这个区域基本不需要大动,除非有特定问题:
2-5kHz 是清晰度和咬字的关键区域。提升这个范围让人声在嘈杂环境中也能听清。
处理方式:在 3kHz 附近做窄 Q 值提升,+2 到 +3dB。这会让齿音(嘶嘶声)也跟着变多,所以接下来要处理齿音。
5-8kHz 范围的齿音过多会刺耳。用齿音消除器(de-esser)比用 EQ 更安全,但如果只有 EQ,在 6-7kHz 做窄 Q 值衰减 -2dB。
10kHz 以上轻微提升 +1 到 +2dB,增加"开放感"。这一步是可选的,对手机外放影响不大,但耳机收听会有差别。
你不可能为每个播放设备单独调 EQ,但可以做针对性的优先级取舍。
手机外放的低频和中低频几乎出不来,高频也被压缩。调 EQ 时:
耳机频响完整,所有频段都能听到,调 EQ 要追求平衡:
车载环境有发动机噪音和路噪,低频干扰严重:
| 听感问题 | 可能原因 | EQ 处理 |
|---|---|---|
| 声音发闷 | 低频堆积 | 300Hz 衰减 -3dB |
| 声音太薄 | 低频不够 | 150Hz 提升 +2dB |
| 声音刺耳 | 齿音过多 | 6-7kHz 衰减 -2dB |
| 咬字不清 | 中高频不够 | 3kHz 提升 +3dB |
| 有嗡嗡声 | 低频噪声 | 高通滤波提到 100Hz |
| 声音"塑料" | 1-2kHz 突出 | 1.5kHz 衰减 -2dB |
| 缺乏质感 | 高频不足 | 8kHz 轻提 +2dB |
你不需要昂贵的插件来做这些调整。免费的 Audacity 就有完整的 EQ 功能,大部分视频编辑器也内置 EQ 滤镜。如果你做批量内容,可以用 FFmpeg 做命令行 EQ 处理,实现自动化。
配音魔方生成的音频是标准 WAV/MP3 格式,可以直接导入任何音频编辑器处理。建议先在编辑器里调好一组 EQ 参数,记下来,后续内容复用同一组参数,省去逐条调的时间。
EQ 的原则是"减法优先"。先处理不需要的频段(高通、低频衰减),再做需要的提升。新手最常犯的错误是到处加增益,结果频段互相叠加,声音越来越糊。每次只调一个参数,听对比,确认有效果再继续下一个。