免费文字转语音 - 浮云梦配音
智能问答

制作蒸汽波音频(放慢 + 低通 + 混响)

蒸汽波的做法就三件事:把速度压到 0.6 到 1.0x 让音调一起沉下去,低通砍掉高频变闷,再补 2.6 秒空间混响。三件事一次渲染完成。

这个效果最适合流行歌、老歌、爵士和商场里放的那种背景音乐。素材编曲越规整、鼓点越清楚,拖慢之后的味道越正;换成纯人声朗读就只剩奇怪的迟缓感,我不拿它处理有声书。

我拿一首 3 分 20 秒的老歌跑了一遍默认预设:出来是 4 分 10 秒左右,末尾还挂着大约 2.9 秒的混响尾巴,那种慵懒的商场背景音乐氛围基本对了。头一次我把低通拉到 1200 Hz,整首歌闷得像隔着一堵墙,只好把截止退回 5000 Hz 重做一遍。

🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理

本地处理本地处理:拖慢、滤波、混响三种运算都在你自己的浏览器内存里跑完,音频文件不会传到服务器上,页面也不留存副本。
格式与限制格式与限制:MP3、WAV、FLAC、M4A 这类常见音频都能读,部分视频里的音轨也能提取;可导出格式由你的浏览器决定,MP3 和 WAV 这两种一定有。单条素材建议控制在 200MB 以内。
合法使用合法使用:请确保你有权处理手上的音频,涉及他人作品或商用场景时更要留意,这个工具不做版权判断。
全员免费
🎵

把文件拖到这里,或者点击选择文件

支持 MP3 / WAV / OGG / FLAC / M4A / AAC 等常见格式;文件不上传,全部在你的浏览器里处理

00:00 / 00:00

0.8x

拖慢的同时音调会一起降下来,这正是蒸汽波的味道

5000 Hz

越低的截止越像老磁带、老收音机

35%

这条链路是:拖慢降调 → 低通变闷 → 加空间混响。三件事一次渲染完成,处理速度取决于文件长度。

不用写扩展名,导出时按所选格式自动补上

本工具累计服务 26 次 今天 10 次 已导出 1 次 全部工具累计 302 次

怎么用:4 步完成

  1. 载入并听原曲拖入音频文件,先在原速下听 20 秒,记住副歌本来的亮度和鼓点位置,拖慢之后才有得对照。
  2. 套一档预设三档预设分别是经典蒸汽波 0.8x、慢速迷幻 0.7x、轻蒸汽 0.9x,点一下会把速度、低通截止和混响量一起配好,先听出差别再决定加不加重。
  3. 微调三个滑块速度 0.6 到 1.0x,低通截止 1000 到 12000 Hz,混响量 0 到 80%。嫌闷就把截止往 8000 Hz 以上推,嫌干就把混响从 35% 往上加 10 到 20 个百分点。
  4. 对着副歌试听再导出挑编曲最满的那 15 秒反复听,人声发糊就回调截止;确认后导出,要再进剪辑软件选 WAV,直接发出去选 192 kbps 以上的 MP3。

一条链路做完三件事:拖慢、低通、2.6 秒混响

蒸汽波的听感不是靠一个滑块凑出来的。三件事要同时发生,少一件就只剩“慢”,不像那个年代的东西。

  • 拖慢并降调:按播放速率把整首曲子拉长,音高跟着一起沉下去。这一条最关键——只做减速而不动音调,人声会变成慢放的新闻播音员,完全不是这个味。
  • 低通变闷:砍掉高频,齿音和镲片的亮边被磨平,留下老磁带、老收音机的那种钝感。
  • 加空间混响:补一条 2.6 秒的尾巴,让声音像在空旷的商场里散出去。

三件事在同一次离线渲染里算完,不用导出、再导入、再来一遍。3 分钟出头的歌,我这边等几秒就拿到结果。

三档预设各管什么素材

点预设会把速度、低通截止和混响量三个数值一次性配好。数值我列在下面,你对照着听更容易判断该往哪边调。

预设速度低通截止混响量适合的素材
经典蒸汽波0.8x5000 Hz35%流行歌、老歌,刚上手从这档起步最稳
慢速迷幻0.7x3200 Hz50%氛围铺垫、间奏、需要模糊成一片背景的段落
轻蒸汽0.9x8500 Hz25%爵士、商场背景音乐,原曲的细节还想留着
自定义0.6–1.0x1000–12000 Hz0–80%三个滑块自己配,幅度越大越挑素材

低通和混响定在哪,我给三个参照

速度和低通是最容易调过头的两个参数。我的习惯是先定速度,再调低通,混响放到后面动。

  • 0.8x 附近最稳:再往下到 0.7x,鼓点的位置感开始松,人声拖出黏滞的尾;0.9x 更像“只是慢了一点点的原曲”。
  • 截止 5000 Hz 是分水岭:5000 Hz 上下能听出闷,还不至于糊;降到 1000 到 2000 Hz,整首歌像隔着门传过来;推到 12000 Hz,几乎只是稍微暗了一点点。
  • 混响 35% 起步:这是默认量。加到 50% 以上尾巴明显,鼓组容易糊;拉到 80% 时干声会自动让位(按 1 减去混响量的一半来衰减),不会爆音,可节奏感也基本没了。

三个滑块之间没有联动,套过预设之后照样能手动覆盖任何一个数值。

它故意不做的几件事,以及边界

老磁带的年代感里,有一部分来自当年的设备缺点:抖晃、底噪、左右声道错位。这个工具一样都没加,它只做速度、滤波、混响三项运算。

  • 不做 wow/flutter,也就是磁带抖晃那种音高微微游走的感觉,成品音高是稳定的。
  • 不加底噪,也不加爆豆声,安静段落仍然是干净的。
  • 不做左右错位,两个声道同步处理,不会出现一边快一点点的情况。

整首歌统一处理,没有只处理某一段的选项。想只把副歌做成蒸汽波,得先去剪辑页切开,处理完再合并回来。还有几条限制要先说清楚:处理全程占用本机内存,两小时以上的素材在内存小的设备上有跑不完的可能,单文件控制在 200MB 以内更稳妥;成品时长等于原时长除以速度,末尾还会多出约 2.9 秒的混响尾巴,拿它给视频卡点得重新排;Safari 读常见格式没问题,可导出的格式比 Chrome 少;IE 和更早的浏览器打不开这个页面。

常见问题

变速页是工具,默认保住音调只改快慢,范围 0.25x 到 4x;这一页是做效果,速度收到 0.6x 到 1.0x,音调本来就该跟着一起沉,还固定串了低通和 2.6 秒混响。想把一首歌原样调快调慢,用变速页;想让它变成另一种味道,用这一页。
差得比想象中多。0.8x 是默认档,人声还听得清咬字,鼓点也在原位;0.6x 落到原速度的六成,人声拖得很慢,鼓点之间的空隙被拉大,整首曲子显出拖沓感。我处理带人声的素材最多退到 0.75x,再低内容就听不清了。
4000 到 5000 Hz 这一段最像。低于 2000 Hz 只剩闷响,镲片和齿音全没了;高于 8000 Hz 时听感接近原曲,只是稍微暗一点。我一般从 5000 Hz 起步,觉得不够复古就一次降 500 Hz 试一遍。
会糊,但不会爆。干声会自动让位置,按 1 减去混响量一半的比例衰减,所以 80% 时干声还剩六成左右。鼓组密集的曲子在这个量下节奏会散,慢歌和氛围段落反而合适;单独的人声素材我最多加到 50%。
这两样是当年录制设备的缺点,不是处理步骤,硬加进去只会牺牲清晰度。想要沙沙的老味道,我的做法是把蒸汽波处理先导出来,再叠一层磁带噪声素材,控制起来比让生成器自己加自由得多。
三类。纯人声朗读拖慢之后只剩怪异的迟缓感,没有复古味;鼓点密集、要卡点的电子舞曲在 0.7x 下节奏全散;本身已经闷的老磁带翻录再砍一次高频只剩一片糊。这三种我试过都不理想,建议先拿 30 秒剪出来试一遍,再决定要不要整首处理。