免费文字转语音 - 浮云梦配音
智能问答

音频变调(升降调,速度不变)

音频可升可降 -12 到 +12 半音,处理完总时长不变。伴奏将就人声、翻唱改调、单句音高修正,都在这一页调。

变调动的是音高,不是速度。拿一首伴奏自己唱,原调太高顶不上去,降两个半音就舒服了,而伴奏长度一点没变,节奏照样对得上。

我拿一段手机录的翻唱试过:副歌有两句偏低,整段 +2 半音之后那两句正了,主歌却显得紧。后来只把副歌剪出来单独 +2 半音,再拼回主歌,才算能听。

🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理

本地处理本地处理:解码、变调、导出都在你自己的浏览器内存里完成,音频不上传服务器,也不需要注册或登录。
格式与限制格式与限制:常见音频格式基本都能读,MP4、MOV 里的音轨部分浏览器也能解;能导出哪些格式由你的浏览器决定,MP3 和 WAV 一定可以。单条素材控制在 200MB 以内比较稳妥。
合法使用合法使用:请确认你有权处理这些音频,翻唱和商用伴奏尤其要注意,工具本身不做版权判断。
全员免费
🎵

把文件拖到这里,或者点击选择文件

支持 MP3 / WAV / OGG / FLAC / M4A / AAC 等常见格式;文件不上传,全部在你的浏览器里处理

00:00 / 00:00
+2 半音

+12 半音等于升高一个八度,-12 等于降低一个八度;改完时长一点不变

不用写扩展名,导出时按所选格式自动补上

本工具累计服务 18 次 今天 3 次 已导出 0 次 全部工具累计 301 次

怎么用:4 步完成

  1. 载入音频拖入音频文件或带音轨的视频,页面解码后可以直接试听原调,先记住原调的位置。
  2. 定半音数滑块范围 -12 到 +12 半音。伴奏将就人声先试 -1 到 -3;听起来只是有点飘的段落,修 1 到 2 半音。
  3. 原调与变调来回切拿同一句在原调和变调之间切两遍。齿音变尖、尾音发飘,说明调多了,往回退 1 到 2 半音。
  4. 确认时长再导出核对文件名旁边显示的时长与原文件一致,然后导出。要再进剪辑软件就选 WAV,直接发用 MP3 选 192 kbps 以上。

-12 到 +12 半音,落在哪个区间才自然

半音是最小的调性单位,动 1 个半音人耳就有感觉。区间不同,能接受的程度差别很大。我给一首吉他弹唱试过 +4 半音,人声还撑得住,弦的泛音已经变了味。

  • ±1 到 ±2 半音:音高微调。跑调一两句、整体略偏高偏低,都落在这个区间,改完基本听不出处理痕迹。
  • ±3 到 ±5 半音:伴奏将就人声、男女声改编。这个幅度下乐器泛音会变,钢琴和吉他比鼓明显。
  • ±6 到 ±12 半音:做音效、做短视频反差、鬼畜素材。人声已经不像原唱,当效果听没问题,当翻唱成品就别指望了。

变调不变速是怎么做到的

先把音频按目标音高重采样,音高上去了,时长也跟着缩短。为了让时长回到原样,再用波形拼接把片段重新排一遍,补回被吃掉的时间。

两步加起来的结果就是:时长与原文件一致,音高随你设的半音数走。副作用藏在细节里——重采样会削掉一部分高频,拼接会带来轻微的非自然感,幅度越大越明显。所以 ±2 半音以内几乎无感,±7 半音以上就该当效果来用了。

我拿同一段四句话的翻唱挨个试过:±1 到 ±2 半音几乎听不出处理痕迹,±6 半音开始冒金属味,±10 半音往上咬字就模糊了。

几个常见用途的参数参考

用途调整量注意
翻唱降调好唱-1 到 -3 半音整段统一降,只降副歌要去剪辑页分段处理
伴奏将就人声±1 到 ±2 半音钢琴、吉他的泛音变化比鼓明显
单句音高修正1 到 2 半音先剪出那一句再升,整段升会把好句子一起带偏
男女声互相改编-5 或 +5 半音超过 5 半音,咬字开始含糊
短视频音效、反差梗+6 到 +12 半音时长不变,对上画面不用重新卡点

变调页的边界

它做的是整段音高平移,一个数字管全曲。想让某一句升、某一句降,得先把素材切开,分别处理好再拼起来,或者索性回剪辑软件做更细的工作。

我现在的做法是先整段试听一遍,记下偏低的是哪几句,再决定要不要切开单独处理。

  • 幅度大到 ±12 半音,人声已经不可辨认,高频损失也重,这类结果只能当音效。
  • 它不会判断哪一句跑调。整段 +2 半音会让原本准的句子也跟着升 2 半音,跑调的地方仍然跑调,只是整体挪了位置。
  • 人声和伴奏分不开。想要只调人声不调伴奏,得先做分轨,这页没有分离功能。
  • 总时长两小时以上的音频,在内存紧张的设备上有跑不完的风险,分开处理会保险一些。
  • Chrome、Edge、Firefox 新版表现正常;Safari 能读,可导出格式不如前者多;IE 和更早的浏览器打不开这个工具。

常见问题

不会。从 -12 到 +12 半音,处理完的时长和原文件一致,导出前你能在页面上直接对一下。这也是它和变速页的区别:变速改长度不改音高,变调改音高不改长度。
先试 -1 到 -3 半音。降 1 个半音大多数人声就能舒展,降 3 个半音音色开始发闷。我一般从 -2 起步,听一遍副歌再决定要不要再降 1 个。
重采样会损失高频,波形拼接会留下轻微的断续,两个副作用都随幅度放大。±2 半音以内基本听不出来,±7 半音以上齿音会变尖、尾音会发飘,这时候当音效用就行。
只能修整体的偏高偏低。它是全段平移,不识别具体哪一句跑了。整段 +2 半音之后,原本准的句子会一起升上去。单句跑调得先在剪辑页把那一句剪出来,单独调完再拼回去。
同一个幅度下差不多,方向不同表现不同。升调更容易听出齿音变尖,降调更容易听出人声发闷、低频变重。我拿一段人声分别跑 +3 和 -3 半音,差别一耳朵就能听出来,自己对比一遍比看参数直观。
需要只改人声不改伴奏的时候。这页没有分轨能力,升降调是人声和伴奏一起动,伴奏的调也跟着变。想要只处理人声,得先有分轨素材,再分别处理。精细的音高曲线编辑它也不做,逐音修音的活儿要交给专业软件。