直播音频工程实操:7步处理链,把“手机直录感”换成“电台质感”
一、先纠正一个优先级
绝大多数新手主播的第一笔预算花在灯上,第二笔花在背景布置上,音频永远是“先用耳机麦凑合”。
但观众的容忍顺序是反的。画质糊一点、色温偏一点,观众会认为“这是手机直播,可以理解”;而一旦出现电流声、房间回声、忽大忽小的爆音,观众不会归因为设备,而会归因为“这人不太专业”,然后划走。
一个零成本的判断方法:闭眼听自己的直播回放10秒。如果你听不出主播离麦克风有多远、听不出房间有多大,说明你的音频链已经把空间信息全部丢掉了,也就是俗称的“手机直录感”。
接下来的7步,按顺序做,每一步都给出参数区间和检查动作。不需要一次到位,但顺序不要跳。
二、第0步:房间(不花钱,但要花30分钟)
音频链的上限由房间决定,处理链只能修,不能造。
要做的四件事:
- 麦克风的正后方不要是空墙。声音打到墙上再弹回来,和你直接说的声音叠加,就是“空旷感”的来源。把桌子挪离墙面30cm以上,或者在墙上挂厚织物。
- 找房间里最空的那面墙,挂上吸音材料,优先处理麦克风对面的墙和侧墙。
- 桌面铺桌布或大鼠标垫。桌面对高频的反射非常直接,是“塑料味”的主要来源。
- 关掉空调、风扇、空气净化器。它们的低频嗡声人耳容易忽略,但麦克风会忠实收录,并且在压缩环节被放大。
三、第1步:拾音——麦克风类型与摆位
类型选择:
- 房间没有做过声学处理,优先动圈麦。动圈麦灵敏度低,收到的房间反射少,这是它在非专业环境里最大的优势。
- 只有房间做过处理(挂了吸音板、无大面积硬墙),才考虑电容麦。电容麦细节多,但也会把缺点放大。
- 距离:15–20cm。太近会有喷麦和低频堆积,太远房间声占比升高。
- 角度:偏轴15–30度,让气流从麦克风旁边过去,而不是正面撞上。这一步能省掉一半的喷麦问题。
- 麦克风不要放在键盘正前方。敲键盘、挪鼠标的震动会通过桌面传导上来,需要用避震架隔离。
- 防喷罩是必需品,不是可选件。
四、第2步:增益——决定后面所有环节的上限
增益是整个链条里最重要、也最容易被忽略的一步。增益设错,后面的压缩、EQ、限幅全部白做。
目标参数:
- 正常说话时,平均电平落在 -18dBFS 附近。
- 情绪激动、大笑、突然提高音量时,峰值不超过 -10dBFS。
不要只录一句“喂喂喂测试”就定增益。用两种状态各录30秒:一种是平静叙述,一种是激动讲解。看两条波形,让两者都在上面给的区间内。
如果只能保一个,保峰值。增益宁小勿大,后级可以补,前级削掉的信息补不回来。
五、第3步:高通滤波
在链条的靠前位置切掉低频,后面的压缩和限幅才不会被无意义的低频能量触发。
参数:
- 频率:80–100Hz,斜率 12dB/oct。
- 男声从80Hz起步,女声从100Hz起步。
- 如果感觉声音变薄,不要关掉高通,回去检查是不是切得太高,而不是切得不够。
六、第4步:降噪与噪声门的“度”
这是新手最容易做坏的一步。插件界面上的强度条,直觉会让人往100%拉,但那是错的。
AI降噪:
- 强度开到 60–70% 就够。
- 开到100%会出现两种典型听感:一是“水下音”,声音像隔着水面传过来;二是吞字,尤其吞句首的辅音,观众听到的句子会缺开头。
- 直播场景里,宁可留一点底噪,也不要牺牲辅音清晰度。底噪不致命,吞字致命。
- 阈值设在底噪之上 3–6dB,不要更高。
- 阈值过高会吞掉句子开头的轻声,听感上就是“话头被剪掉了”。
说一句“四十四只石狮子”,反复说三遍。回放时听 s、sh 有没有被吃掉。如果句首的“四”听起来像“一”,说明降噪或噪声门开过头了。
七、第5步:压缩
压缩解决的是“小声说话听不清、大笑震耳朵”的问题,它是让直播声音稳定的核心环节,不是可选项。
参数起步值:
- 比率:3:1 到 4:1
- 阈值:调到让最大的笑声刚好超过阈值
- Attack:10ms(太快会削掉瞬态,太慢会漏掉爆音)
- Release:100ms 左右
- 增益补偿:3–6dB
先设阈值,再调补偿。目标是让“平静说话”和“激动大笑”在监听耳机里的响度接近。不要为了响度把补偿拉满,那会让整体音量顶到限幅器上,动态就死了。
如果麦克风前有两个说话的人(比如访谈式直播),压缩比率可以升到 4:1 以上,但要接受一部分细节损失。
八、第6步:EQ
EQ的原则是“先减后加”,不要在没减的情况下先加。
三处常规处理:
- 250–400Hz 减 2–3dB:这是“闷”“箱体感”的来源。减掉之后人声会立刻变通透。
- 2.5–4kHz 提 1–2dB:这是清晰度和咬字感的频段。提的时候小步走,一次0.5dB,边提边听。
- 6–8kHz:看情况。齿音重就减,声音发暗就微提。
九、第7步:限幅
限幅器放在链条的最末端,是安全网,不是音量控制工具。
参数:
- 天花板:-1dBTP(给编码和平台转码留余量)
- 不要用限幅器来“让声音更大”,那是压缩和增益补偿的职责
十、直播中的实时监控与应急
监听原则:
耳机里必须监听最终输出的声音,而不是麦克风直出的声音。很多人监听的是麦克风,结果听到的是“未经处理的自己”,而观众听到的是“处理后加爆音的自己”,两边完全不是一回事。
双备份:
至少准备两条音频路径:推流软件的音频链一条,声卡硬件监听一条。软件崩的时候,硬件还能顶。
三类突发情况的急救流程:
- 爆音:静音 → 检查是否有人碰到了线材或麦克风架 → 如果继续,降增益而不是加限幅。
- 啸叫:静音 → 第一反应检查是不是开了外放(耳机没插好是最高频的原因)→ 其次检查麦克风和音箱的相对位置。
- 断流后复播:复播前先静默3秒看电平表,确认没有异常峰值再开口。很多人复播第一句就爆音,因为上一轮的增益状态还留着。
十一、参数速查表
| 环节 | 关键参数 | 一句话目的 |
|---|---|---|
| 房间 | 麦克风后方离墙30cm以上 | 减少反射 |
| 拾音 | 距离15–20cm,偏轴15–30° | 减少喷麦与房间声 |
| 增益 | 平均-18dBFS,峰值≤-10dBFS | 定上限 |
| 高通 | 80–100Hz,12dB/oct | 切低频垃圾 |
| 降噪 | 60–70%,噪声门高于底噪3–6dB | 保辅音,不吞字 |
| 压缩 | 3:1–4:1,Attack 10ms,Release 100ms | 稳定响度 |
| EQ | 250–400Hz减2–3dB,2.5–4kHz提1–2dB | 去闷提清晰 |
| 限幅 | 天花板-1dBTP | 只做安全网 |
十二、五个常见误区
- 以为买个贵麦克风就解决了。 麦克风只是链条的一环,房间和增益比麦克风型号重要得多。
- 降噪开满。 见第4步,吞字的代价远大于底噪。
- 只压缩不补偿。 压缩之后整体变小,不补增益等于把声音做小了。
- 用限幅器控制音量。 限幅器是安全网,不是推子。
- 监听麦克风直出。 你听到的和观众听到的不是同一个声音,等于闭着眼调音。
最后:一次只改一个环节
音频链最容易犯的错误不是参数错,而是一次性调五个环节,然后不知道是哪一个变好了,哪一个是变坏的原因。
正确做法是:按第0步到第7步的顺序,每调一步,录30秒,回放,确认比上一步好,再动下一步。
整条链调完,正常需要两到三个小时。但这两三个小时换来的是:之后每一场直播,观众听到的都是同一套稳定的声音,而不是靠运气。