音频音量放大(把录音声音调大)
音频音量可在 -24 到 +24 dB 之间加增益,峰值归一化目标选 -1、-3 或 -6 dBFS,限幅三档防爆音,处理完直接读峰值与 RMS。
采访、手机外录、课件录音有个共同毛病:声音偏小,耳机开到满格还是听不清字。加增益只是把整体电平推上去,真正决定听着舒不舒服的,是峰值有没有贴到 0 dBFS。
我自己拉过一遍:一段峰值 -12 dBFS 的采访,直接加 +12 dB 就顶到 0 dBFS 附近,两人同时笑的地方最容易削,听感发毛;改成 +8 dB 配软限幅,峰值落在 -4 dBFS 左右,页面上的削波计数回到 0。
🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理
把文件拖到这里,或者点击选择文件
支持 MP3 / WAV / OGG / FLAC / M4A / AAC 等常见格式;文件不上传,全部在你的浏览器里处理
口播素材一般 -3 到 +9 dB 就够,别一上来拉满
勾选后上面的增益失效,直接把最大波峰拉到目标电平
处理完下面会显示峰值和平均音量(RMS)。如果削波采样点不是 0,就是放大过头了,把增益调小或者改用软限幅。
不用写扩展名,导出时按所选格式自动补上
怎么用:4 步完成
- 载入音频看底数拖入文件后页面先解码,并显示原始峰值与 RMS 读数,先看清这段素材到底欠了多少电平。
- 设增益或归一化只是整体偏轻就填 +6 到 +12 dB;想让几条素材响度接近,改勾峰值归一化,目标选 -1、-3 或 -6 dBFS。
- 挑限幅档位口播旁白用软限幅;素材里有掌声、关门声这类尖峰就换硬限幅,代价是尖峰被压得有点平。
- 核对读数再导出处理后看削波采样点数量。我习惯不是 0 就把增益降 2 到 3 dB 重跑一遍,确认干净了再导 MP3 或 WAV。
增益、归一化、限幅是三件不同的事
把它们混为一谈,是这类工具用不好的主要原因。三个动作改的东西不一样,读数也不一样。我起先只勾了归一化,一条采访被顶到 -1 dBFS,笑声照样发破。
- 增益:把整段电平平移,-24 到 +24 dB 连续可调。你填 +8 dB,所有采样点一起抬高,形状不变。
- 峰值归一化:把这段音频的峰值顶到指定目标,可选 -1、-3、-6 dBFS。抬多少由素材自己决定,你不填数字。
- 限幅:只在超过阈值的地方压住,防止尖峰爆掉。分不处理、软限幅、硬限幅三档,软限幅留一点弹性,硬限幅直接贴住阈值切。
顺序上是先增益,再过限幅。增益填过头,限幅只能补救,不能还原。
四个常见场景的参数搭法
| 场景 | 增益 | 归一化目标 | 限幅档 |
|---|---|---|---|
| 口播、采访补录 | +6 到 +12 dB | 不勾,手动控 | 软限幅 |
| 整段手机外录 | +8 到 +15 dB | -3 dBFS | 软限幅 |
| 现场录音(带掌声尖峰) | +3 到 +6 dB | -6 dBFS | 硬限幅 |
| 多条播客素材对齐响度 | 不动 | -1 dBFS | 不处理 |
| 交付前留余量的成品 | 0 dB | -1 dBFS | 不处理 |
峰值和平均音量为什么要分开看
峰值是这段音频里最高的那一个采样点,RMS 是整段的平均能量。一段话里如果有人突然拍了桌子,峰值会很高,RMS 却不高;只看峰值你会以为它够响,回放却发现人声还是小。
我的习惯是先看 RMS:语音素材的 RMS 落在 -20 到 -16 dBFS 之间,戴上耳机听一般不用再调。然后看峰值,只要离 -1 dBFS 不远,导出给平台就安全。两个读数差得特别大,说明动态范围大,这时硬限幅比继续加增益靠谱。
削波采样点数量:导出前的把关数字
面板上那个削波采样点数量,比任何听感描述都直接。它是超过了满刻度的采样点个数,数字越大,破音越明显。填 +3 dB 听着没什么变化,削波点可能已经上千。
我的做法:数字不是 0,就把增益回调 2 到 3 dB,或者把限幅从软换到硬。返工两次之内基本能拿到干净的结果。
音量页做不到的事
它调的是电平,不是音质。底噪会跟着增益一起被抬起来,一段录了空调声的素材,加 +15 dB 之后空调声同样放大 +15 dB,这时候该去重录而不是继续调数。
- 总时长两小时以上、单文件接近 200MB 时,内存小的设备可能跑不完,建议先分段处理。
- 它不做多段之间的自动对齐,也不会按人声和音乐分别处理,混音活儿不归它管。
- Chrome、Edge、Firefox 新版表现一致;Safari 读文件没问题,能导出的格式可选项要少一些。
- 压缩器、均衡、降噪都不在面板上,这页只有增益、归一化、限幅三样。