免费文字转语音 - 浮云梦配音
智能问答

音频音量放大(把录音声音调大)

音频音量可在 -24 到 +24 dB 之间加增益,峰值归一化目标选 -1、-3 或 -6 dBFS,限幅三档防爆音,处理完直接读峰值与 RMS。

采访、手机外录、课件录音有个共同毛病:声音偏小,耳机开到满格还是听不清字。加增益只是把整体电平推上去,真正决定听着舒不舒服的,是峰值有没有贴到 0 dBFS。

我自己拉过一遍:一段峰值 -12 dBFS 的采访,直接加 +12 dB 就顶到 0 dBFS 附近,两人同时笑的地方最容易削,听感发毛;改成 +8 dB 配软限幅,峰值落在 -4 dBFS 左右,页面上的削波计数回到 0。

🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理

本地处理本地处理:增益、归一化、限幅都在你自己的浏览器内存里计算,音频不上传服务器,也不需要注册或登录。
格式与限制格式与限制:浏览器能解码的格式一般都能读;导出以 MP3 和 WAV 为准,WebM(Opus)、OGG(Opus) 能不能导由你的浏览器决定。素材越大处理越慢,超过 200MB 的文件建议先切段再调。
合法使用合法使用:请确认你有权处理这些录音,工具本身不做版权判断。
全员免费
🎵

把文件拖到这里,或者点击选择文件

支持 MP3 / WAV / OGG / FLAC / M4A / AAC 等常见格式;文件不上传,全部在你的浏览器里处理

00:00 / 00:00
+6 dB

口播素材一般 -3 到 +9 dB 就够,别一上来拉满

勾选后上面的增益失效,直接把最大波峰拉到目标电平

处理完下面会显示峰值和平均音量(RMS)。如果削波采样点不是 0,就是放大过头了,把增益调小或者改用软限幅。

不用写扩展名,导出时按所选格式自动补上

本工具累计服务 18 次 今天 2 次 已导出 1 次 全部工具累计 293 次

怎么用:4 步完成

  1. 载入音频看底数拖入文件后页面先解码,并显示原始峰值与 RMS 读数,先看清这段素材到底欠了多少电平。
  2. 设增益或归一化只是整体偏轻就填 +6 到 +12 dB;想让几条素材响度接近,改勾峰值归一化,目标选 -1、-3 或 -6 dBFS。
  3. 挑限幅档位口播旁白用软限幅;素材里有掌声、关门声这类尖峰就换硬限幅,代价是尖峰被压得有点平。
  4. 核对读数再导出处理后看削波采样点数量。我习惯不是 0 就把增益降 2 到 3 dB 重跑一遍,确认干净了再导 MP3 或 WAV。

增益、归一化、限幅是三件不同的事

把它们混为一谈,是这类工具用不好的主要原因。三个动作改的东西不一样,读数也不一样。我起先只勾了归一化,一条采访被顶到 -1 dBFS,笑声照样发破。

  • 增益:把整段电平平移,-24 到 +24 dB 连续可调。你填 +8 dB,所有采样点一起抬高,形状不变。
  • 峰值归一化:把这段音频的峰值顶到指定目标,可选 -1、-3、-6 dBFS。抬多少由素材自己决定,你不填数字。
  • 限幅:只在超过阈值的地方压住,防止尖峰爆掉。分不处理、软限幅、硬限幅三档,软限幅留一点弹性,硬限幅直接贴住阈值切。

顺序上是先增益,再过限幅。增益填过头,限幅只能补救,不能还原。

四个常见场景的参数搭法

场景增益归一化目标限幅档
口播、采访补录+6 到 +12 dB不勾,手动控软限幅
整段手机外录+8 到 +15 dB-3 dBFS软限幅
现场录音(带掌声尖峰)+3 到 +6 dB-6 dBFS硬限幅
多条播客素材对齐响度不动-1 dBFS不处理
交付前留余量的成品0 dB-1 dBFS不处理

峰值和平均音量为什么要分开看

峰值是这段音频里最高的那一个采样点,RMS 是整段的平均能量。一段话里如果有人突然拍了桌子,峰值会很高,RMS 却不高;只看峰值你会以为它够响,回放却发现人声还是小。

我的习惯是先看 RMS:语音素材的 RMS 落在 -20 到 -16 dBFS 之间,戴上耳机听一般不用再调。然后看峰值,只要离 -1 dBFS 不远,导出给平台就安全。两个读数差得特别大,说明动态范围大,这时硬限幅比继续加增益靠谱。

削波采样点数量:导出前的把关数字

面板上那个削波采样点数量,比任何听感描述都直接。它是超过了满刻度的采样点个数,数字越大,破音越明显。填 +3 dB 听着没什么变化,削波点可能已经上千。

我的做法:数字不是 0,就把增益回调 2 到 3 dB,或者把限幅从软换到硬。返工两次之内基本能拿到干净的结果。

音量页做不到的事

它调的是电平,不是音质。底噪会跟着增益一起被抬起来,一段录了空调声的素材,加 +15 dB 之后空调声同样放大 +15 dB,这时候该去重录而不是继续调数。

  • 总时长两小时以上、单文件接近 200MB 时,内存小的设备可能跑不完,建议先分段处理。
  • 它不做多段之间的自动对齐,也不会按人声和音乐分别处理,混音活儿不归它管。
  • Chrome、Edge、Firefox 新版表现一致;Safari 读文件没问题,能导出的格式可选项要少一些。
  • 压缩器、均衡、降噪都不在面板上,这页只有增益、归一化、限幅三样。

常见问题

增益范围 -24 到 +24 dB。上限不是那个数字,而是 0 dBFS 这条线:峰值顶到 0 dBFS 就没余量了,多数平台回放还会再处理一次,所以我一般把目标停在 -1 到 -3 dBFS。
单条素材知道自己欠多少电平,就填增益,控制权在你手里。几条素材要凑到一起响度接近,勾归化省事,你只需要选 -1、-3 或 -6 dBFS 的目标。
软限幅是渐进地压,超过阈值后曲线慢慢弯,听感自然一点,尖峰仍有少量溢出。硬限幅贴住阈值切,读数干净,代价是尖峰被压平,用在掌声、摔门这类素材上合适。
先看削波采样点数量。这个数字不是 0,说明增益给多了,回调 2 到 3 dB 再跑一次。如果数字是 0 还觉得刺,多半是原始素材在录制时就爆了,任何后期都补不回来。
语音素材落在 -20 到 -16 dBFS 之间,戴耳机听通常不用再动。音乐素材可以推到 -14 dBFS 附近。读数只是参考,同一段素材在手机外放和监听耳机上的感受差别不小,我用两套设备各听一遍才定稿。
它只动电平,不动音质。原始录音里的底噪、回声、爆音会一起被放大,这类素材得先重录或用别的工具处理。它也不做响度标准化到某个行业数值,要精确对齐多条成品,得靠耳朵配合峰值与 RMS 两个读数自己判断。