免费文字转语音 - 浮云梦配音
智能问答

音频压缩,减小 MP3 文件体积

音频压缩靠降码率:语音 64 kbps/22.05 kHz 单声道,播客 96 kbps/44.1 kHz 单声道,音乐 192 kbps,输出在本地完成。

体积和听感是一道换算题。64 kbps 的语音每分钟约 0.47MB,96 kbps 约 0.70MB,192 kbps 约 1.41MB,320 kbps 到 2.34MB。同一段人声压到 64 kbps 还能听清每个字;同一首歌压到 64 kbps,镲片和混响尾巴先糊掉。

45 分钟的课堂录音,原始 WAV 大约 476MB;同样的内容按语音预设导出,只剩 21MB 上下,人声的清晰度没什么损失。可同一套参数套到钢琴曲上就废了,高音区发闷,这种素材得退回 192 kbps。预设不能瞎套,得看素材里有没有乐器。

🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理

本地处理压缩在你自己的浏览器里完成,音频文件不会上传到服务器。头一回导出 MP3 时页面要取一次约 120KB 的编码脚本,除此之外不再联网。
格式与限制能压成什么由浏览器决定:MP3(32–320 kbps 八档)和 WAV(16 位/24 位)一定可用;装 Opus 的 WebM、OGG 得看浏览器支持,Safari 上还能导 M4A。想压得更小,除了降码率还能一起降采样率和声道数。单文件建议不超过 200MB,两小时以上的音频在小内存设备上可能失败。
合法使用压缩不改变版权归属,请确认你有权处理这段音频,这一页不会替你判断能不能公开。
全员免费
🎵

把文件拖到这里,或者点击选择文件

支持 MP3 / WAV / OGG / FLAC / M4A / AAC 等常见格式;文件不上传,全部在你的浏览器里处理

00:00 / 00:00

本工具累计服务 18 次 今天 2 次 已导出 1 次 全部工具累计 297 次

怎么用:4 步完成

  1. 拖入要瘦身的音频MP3、WAV、FLAC、M4A、OGG、Opus、WebM 都能读。一个 120MB 的 WAV 拖进去后要先解码,这一步占的时间最长。
  2. 挑一个预设语音 64 kbps/22.05 kHz 单声道,播客 96 kbps/44.1 kHz 单声道,音乐 192 kbps,高音质 320 kbps。四档都不合用时切到自定义,自己填码率。
  3. 按下导出浏览器按你选的参数重新编码。一段 30 分钟的语音压到 64 kbps,输出大约 14MB。
  4. 比一比新旧文件原文件和压缩后的各放一遍,重点听齿音、鼓点和安静段落的底噪。听不出差别,说明这组参数还能再往下压一档。

四档预设分别压给谁听

预设的意义是省掉试参数的时间。四档加上自定义,覆盖了大多数场景:

预设码率采样率与声道适合什么
语音64 kbps22.05 kHz 单声道课程、会议、访谈这类只有人声的录音
播客96 kbps44.1 kHz 单声道双人对话、口播稿,比语音那一档多留一点空间感
音乐192 kbps以页面显示为准歌曲、BGM,日常播放听不出损失
高音质320 kbps以页面显示为准还要进剪辑软件的素材
自定义自己填以页面显示为准有明确体积目标时用

后面三行的采样率与声道没有固定值,页面会显示当前取值,我不替它编数字。给别人做口播稿时我固定用播客那一档,44.1 kHz 保留了齿音的细节,96 kbps 又不会让文件太胖。

码率降一半,体积也降一半:一份换算表

这些数字是从码率算出来的,不是拍脑袋:码率除以 8 得到每秒多少 KB,乘 60 就是每分钟的体积。

码率每分钟体积30 分钟45 分钟
64 kbps约 0.47 MB约 14 MB约 21 MB
96 kbps约 0.70 MB约 21 MB约 32 MB
128 kbps约 0.94 MB约 28 MB约 42 MB
192 kbps约 1.41 MB约 42 MB约 63 MB
320 kbps约 2.34 MB约 70 MB约 106 MB

实测会差一点点,文件头、曲目信息、封面图都要占地方。把 320 kbps 的 MP3 压到 64 kbps,体积掉到五分之一上下,手机外放听不出损失,戴上监听耳机就很明显。

语音和音乐不能套同一组参数

人声的能量集中在 300 Hz 到 3.4 kHz。22.05 kHz 采样率能覆盖到 11 kHz 上下,说话够用,还省掉一大半数据。音乐不认这套逻辑,镲片、弦乐泛音、混响尾巴全在高频,采样率一砍,空气感先没。

  • 只有人说话:64 kbps/22.05 kHz 单声道,压到十分之一都还能听。
  • 人声加上背景音乐:至少 96 kbps。带 BGM 的素材用单声道,乐器会明显变窄。
  • 纯音乐、有声书配乐:192 kbps 起步,要留后路就 320 kbps。
  • 后面还要剪、还要混:先别压,等成品定稿再说。

我踩过一次坑:一段带钢琴垫底的旁白压到 64 kbps,人声没事,钢琴听起来像隔了层毛玻璃。换成 96 kbps 重导,那层毛玻璃就退了。

边界与限制

  • 压缩有损,回不去。压完再转成 WAV,丢掉的高频也不会回来。
  • 预设只覆盖常见场景。人声夹着音乐、方言录音这类混合素材,得自己试参数。
  • 内存是上限。两小时以上的音频在小内存设备上可能失败,单文件建议 200MB 以内。
  • 浏览器有门槛。IE 和老版本浏览器跑不起来;Safari 上可选的导出格式比 Chrome、Edge、Firefox 少。

它也不做修复。底噪、爆音、忽大忽小的音量,压缩之后只会跟着一起变小,不会变干净;音量问题交给自己去音量调节处理,格式问题看音频格式转换。

常见问题

看压到什么程度。192 kbps 的 MP3 和我手上的原始 WAV 反复对比,差别很细微;压到 64 kbps,只有纯人声还行,带配乐的内容会发闷。想留余地就停在 128 kbps 以上。
多半是源文件码率本来就低。把一段 48 kbps 的语音转成 192 kbps,文件只会更大,声音不会变好。压缩的前提是源文件里还有可以丢的余量。
11 kHz 以上的频率被切掉。说话声基本落在这条线以下,听不出什么变化;音乐里的镲片和泛音正好压在那上面,会明显发暗。只有纯人声时用 22.05 kHz 才划算。
能。导出的是普通 MP3 或 WAV,微信、邮箱、车载音响、剪辑软件都认。需要留意语音预设输出的是单声道,放到双声道设备上,左右耳听到的是同一条信号。
比几秒长得多。等待时间跟文件大小和这台机器的内存挂钩。小文件几秒到几十秒,几百兆的 WAV 就得等上几分钟。
它只压体积,不做修复:不降噪、不去混响、不修削波,也救不回已经压坏的声音。源文件本来是 48 kbps 的话,再往下压只会更糟。长音频还受内存限制,两小时以上的文件在小内存设备上可能跑到一半失败。