免费文字转语音 - 浮云梦配音
智能问答

音频加速(把歌曲变快,可同时升调)

加速倍数 1.05x 到 2.5x,默认连音调一起升高,出来的就是平台上那种加速版;取消勾选才只提速、音调留在原位。

同一首歌,1.25x 加升调听着提神,1.25x 只提速就只是“快了一点”。开机之前先想清楚要哪一种:给短视频配一个加速版,还是给一段会议录音省时间。

我拿一首 3 分 20 秒的歌跑过对照。勾着升调走 1.25x,一秒不到就出结果,长度缩到 2 分 40 秒,人声亮了一截,正好是刷到的那种加速版味道;同样 1.25x 取消勾选走波形拼接,等了大约 12 秒,音调稳在原样,当背景音乐更耐听。

🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理

本地处理本地处理:整个加速过程在你自己的浏览器里完成,音频文件不会上传,页面也不留存副本,不需要注册登录。
格式与限制格式与限制:浏览器能解码的音频都能读,视频里的音轨部分也能提取;可导出格式取决于你的浏览器,MP3 和 WAV 这两项一定有。单文件建议不超过 200MB。
合法使用合法使用:处理他人作品前先确认授权,加速版发到平台上同样要考虑这一层,工具不做版权判断。
全员免费
🎵

把文件拖到这里,或者点击选择文件

支持 MP3 / WAV / OGG / FLAC / M4A / AAC 等常见格式;文件不上传,全部在你的浏览器里处理

00:00 / 00:00
1.25x

1.25x 是短视频里最常见的档位,2x 基本就是鬼畜速度了

勾选:加速且升调,就是社交平台上那种加速版;取消:只加速,音调保持不变

加速版和变速工具的区别:这一页是做效果(默认连音调一起升),变速页偏工具向(默认保持音调)。

不用写扩展名,导出时按所选格式自动补上

本工具累计服务 15 次 今天 2 次 已导出 0 次 全部工具累计 298 次

怎么用:4 步完成

  1. 载入原始音频拖入音频文件,先在原速下听 10 秒,记住它本来的音高和节奏位置,加速之后才知道变了多少。
  2. 选加速倍数滑块从 1.05x 到 2.5x,默认停在 1.25x。短视频配乐常停 1.25x 到 1.35x,超过 2x 就只剩鬼畜那种感觉了。
  3. 决定要不要升调默认勾选「同时升高音调」,这就是加速版的听感,走重采样几乎不用等;给口播、会议录音提速就取消勾选,只加速不动音调。
  4. 试听对比再导出用同一句歌词在原速与加速之间切两遍,确认人声没有尖到刺耳,然后导出。发平台选 192 kbps 以上的 MP3,要继续剪辑选 WAV。

加速版其实是两个动作:提速加升调

平台上那种加速版,听感上的“更快”只占一半,另一半是音调整体被抬上去。人声变亮变薄,伴奏跟着往上走,整首歌才显得精神。

所以这一页默认就把音调变化配好:勾选状态下按倍数重采样,快多少就升多少,1.25x 大约把音高抬了 4 个半音。取消勾选之后,工具改用波形拼接(SOLA)把时长压短,音调留在原处,代价是处理时间随文件长度一起涨。

倍速档位怎么挑

倍数越高,音调抬得越狠,人声越像换了个人。下面这几档是我自己常用的对照,直接拿来起步就行。

倍数听感变化适合的场景
1.05x–1.15x几乎听不出变快,音调略亮老录音想精神一点,又不想让人察觉处理过
1.25x默认档,加速版的典型速度短视频配乐、日常 vlog 垫底音乐
1.5x快得明显,人声偏亮偏薄把一段 4 分钟的音频压到 2 分 40 秒左右
2x音高正好抬了一个八度鬼畜、反差梗,当效果听
2.5x上限档,咬字基本糊在一起只做卡点素材,或者纯粹好玩

和音频变速页怎么分工

两个页面都能让音频变快,默认值和适用范围不一样,选错会白折腾一轮。

  • 默认音调:这一页默认连音调一起升;变速页默认保住音调,只改快慢。同样是 1.25x,两页出来的声音不是一回事。
  • 倍数范围:这里只有 1.05x 到 2.5x,方向是变快;变速页从 0.25x 到 4x,变慢也归它管。
  • 处理速度:这一页默认重采样,几乎不用等;变速页默认波形拼接,几分钟的素材要等十几秒。
  • 我什么时候用哪个:做短视频加速版、给垫底音乐提神,用这一页;整理会议录音、听外语材料,用变速页。

一句话记:这一页做效果,变速页做工具。

这个工具的边界

它一次处理整段音频,一个倍数对整首歌生效。想让前奏原速、副歌加速,得先剪成两段分别处理,再用合并页按顺序拼回去。

  • 取消勾选升调之后,波形拼接在人声上会留下轻微断续,倍数越高越明显。我给一段 8 分钟的采访做过 1.5x,句子尾部能听出一点毛边。
  • 加速之后再加速属于二次处理,两次拼接的非自然感会累加。能拿原文件重做,就别在成品上反复折腾。
  • 咬字清晰度是有代价的。2x 已经很难当正常语速的人声听,配套字幕对轴也要整段重做。
  • 处理全程占用本机内存,两小时以上的素材在内存小的设备上有失败的可能,先切成几段更保险。
  • Chrome、Edge、Firefox 新版都正常;Safari 能读常见格式,可导出的格式少一些;IE 和更早的浏览器打不开。

常见问题

默认勾着「同时升高音调」,所以会一起变高,1.25x 大约升高 4 个半音,这正是加速版听感的来源。不想改音调就取消勾选,工具改用波形拼接把时长压短,音高留在原样,代价是等待时间随文件长度增加。
听得出来。1.25x 像原曲稍微提了下速,歌词还能跟着哼;1.5x 人声明显变亮变薄,长句的换气位置都被压掉了。同一首 3 分 20 秒的歌,1.25x 是 2 分 40 秒,1.5x 是 2 分 13 秒左右,做短视频我多数停在 1.25x。
素材里有必须听清内容的人声时。会议录音、访谈、外语听力材料抬了音调之后,人名和数字更容易听岔;反过来,纯音乐、短句金句、鬼畜素材,升调才是要的效果。我处理采访一律取消勾选。
两种处理方式不一样。升调走重采样,采样点重新排一遍就完事,几乎瞬间完成;保持音调得逐段找相似片段再码放,文件越长找得越久。十几分钟的素材取消勾选,等半分钟很正常。
默认设置下不一样。加速页默认把音调一起抬上去,变速页默认保持音调,同样填 1.25x,出来的是两种声音。想让两页结果对上也可以:加速页取消勾选,或者变速页取消保持音调,两边就一致了。
要严格对齐画面卡点的音乐,加速后节拍位置全变,得回剪辑软件重排;本来就在高音区的女声,1.5x 之后尖得刺耳;要逐句对齐字幕的口播,对轴工作等于重做一遍。它也不做局部加速,整段只认一个倍数,没有只加快某一句的选项。