免费文字转语音 - 浮云梦配音
智能问答

音频工具箱(浏览器本地处理,不上传文件)

这台设备就是处理器:剪切、转换、音量、倒放、变速、压缩都在你浏览器里算完,音频不上传服务器,也不用注册登录。

我最常干的一件事是把录坏的口播救回来:进音频剪辑掐掉开头那两秒杂音,再用音量放大的峰值归一化拉到 -3 dBFS,中间一直没离开这个浏览器标签。

给视频配旁白的话路径更短。我用视频提取音频把 MP4 里的音轨拆出来,进音频压缩按语音 64 kbps 走一遍,三分钟的素材很快就能拿到 MP3。边界也说清楚:全程吃本机内存,单个文件建议不超过 200MB,两小时以上的素材在内存小的机器上容易中途失败。

🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理

本地处理工具箱里每个工具都在你自己浏览器的内存里运行:音频不上传服务器,服务器不留存,也不需要注册和登录。
格式与限制能读什么、能导出什么由你的浏览器决定:MP3、WAV、OGG、Opus、FLAC、M4A/AAC、WebM 一般都能读,可导出格式在 Chrome、Edge、Firefox 上比 Safari 多一些。
合法使用请确认你有权处理这些音频。翻录、倒放、变速别人的作品再发布可能涉及版权,工具不做版权判断。
✂️
音频剪辑在波形上拖出选区,精确到毫秒地截取你真正需要的那一段波形选区全员免费已服务 27 次
🔄
音频格式转换MP3、WAV、WebM、OGG 互转,码率、采样率、声道自己定格式互转全员免费已服务 21 次
➕
音频合并多段音频按顺序拼成一个文件,可交叉淡化、可统一音量多文件全员免费已服务 16 次
🔊
音量放大增益、峰值归一化、限幅三件套,放大不爆音防爆音全员免费已服务 17 次
⏪
音频倒放整段倒放,或者只把波形上选中的那一小段倒过来选区倒放全员免费已服务 15 次
⏩
音频变速0.25x 到 4x 变速,可选保持音调不变成唐老鸭保持音调全员免费已服务 17 次
🎚️
音频变调升降调 -12 到 +12 半音,时长一点都不变半音级全员免费已服务 17 次
🗜️
音频压缩把几十兆的录音压到几兆,语音和音乐各有取向减小体积全员免费已服务 17 次
🎙️
在线录音浏览器直接录,带电平表和暂停,录完就能导出麦克风全员免费已服务 15 次
🎬
视频提取音频从 MP4、MOV、WebM 里把音轨取出来视频音轨全员免费已服务 21 次
🔇
去除静音自动删掉录音与播客里的停顿、空白段,把节奏压紧自动识别全员免费已服务 15 次
🌫️
添加混响程序生成的空间混响,房间、大厅、教堂都能调空间感全员免费已服务 38 次
🎧
双声道转单声道合并左右声道、只留一侧,或者拆成两个文件声道处理全员免费已服务 15 次
🌴
蒸汽波生成器拖慢、变闷、加混响,一键做出慵懒复古味风格化全员免费已服务 25 次
🚀
音频加速做短视频常见的加速版(Sped-up)效果,可同时升调Sped-up全员免费已服务 14 次
全部工具累计服务 290 次 今天 57 次 已导出 5 次

怎么用:四步走完一件事

  1. 挑工具。掐头去尾进音频剪辑,换封装进音频格式转换,几段拼成一条进音频合并;拿不准就先看下面那张对照表。
  2. 导入文件。点选择文件,或者直接把文件拖进页面,浏览器先解码再画出波形。单个文件建议不超过 200MB。
  3. 调参数。选区精确到毫秒,增益 -24 到 +24 dB,变速 0.25x 到 4x,变调 -12 到 +12 半音,压缩从 64 kbps 到 320 kbps 自己挑。每个页面只露出它自己那几个旋钮,不会把整箱参数铺在你面前。
  4. 导出。选 MP3 或 WAV 之后下载到本机。首次导出 MP3 要先加载约 120KB 的编码脚本,加载失败就改用 WAV,一样拿得到文件。

工具之间能接力。我在线录音录完一段口播,先过一遍去除静音,再进音频合并接到片头后面,中间没有换软件,也没有第二次解码的等待。三十分钟的素材我一般按这个顺序跑,从头到尾不出浏览器。

文件不上传,为什么反而更快、更安全

省掉的是上传和下载两个来回。一段 150MB 的录音要先传到服务器、再排队等处理,光路上就吃掉不少时间,中途断一次还得从头再来。本机处理没有这一段,拖进文件就开始解码。

隐私上的差别更实在。音频不会出现在任何一次网络请求里,服务器收不到音频,也收不到文件名——从选择文件到导出完成,它一直待在这台设备的内存里。会议录音、客户访谈、还没发布的样音,这类素材放在本机处理,心理负担小得多。

想自己核实也简单:导入文件之后打开开发者工具的网络面板,处理期间只有页面本身和那个约 120KB 的 MP3 编码脚本在下载,找不到任何上传音频的请求。

页面打开之后,处理环节连网络都不需要。我在断网的笔记本上剪过一段采访,照样导出了 MP3,只有刚打开页面那一下要联网。

代价得认:算力从服务器换到了你自己这台机器上。内存 8GB 的老笔记本处理一小时的音频会明显变慢,风扇也会转起来;机器新一些就基本感觉不到。

支持与不支持什么

项目情况
处理位置全部在你浏览器的内存里完成,文件不上传
注册与登录都不需要
输入格式MP3、WAV、OGG、Opus、FLAC、M4A/AAC、WebM;部分 MP4、MOV 视频里的音轨也能读
输出格式MP3(32 到 320 kbps)、WAV(16 位或 24 位)、WebM(Opus)、OGG(Opus),Safari 上还能导出 M4A
长度与体积建议单个文件控制在 200MB 以内;两小时以上的素材在内存较小的设备上可能中途失败
浏览器Chrome、Edge、Firefox 新版最完整;Safari 能处理常见格式但可导出格式较少;IE 与老版本浏览器不支持
网络首次打开页面需要联网;导出 MP3 时加载约 120KB 的编码脚本
做不到的事不做云端存储、不做人声与伴奏分离、不做多轨编曲、不剪辑视频画面
版权不判断素材来源,请自己确认有权处理

工具怎么选:按你手上的文件对号入座

工具什么时候用它它独有的参数
音频剪辑掐头去尾,只要中间那一段毫秒级选区,0 到 10 秒淡入淡出走等功率曲线
音频格式转换MP3 想换 WAV,M4A 想换 MP3浏览器能解与能导的格式差异,码率、采样率、声道自己定
音频合并几段录音拼成一条每段单独增益 -40 到 +40 dB、交叉淡化 0 到 10 秒、段间静音 0 到 60 秒
音量放大声音太小,或者忽大忽小增益 -24 到 +24 dB、归一化目标 -1/-3/-6 dBFS、三档限幅,处理完给峰值与 RMS 读数
音频倒放做音效、做鬼畜素材整段倒放,或者只把选区里那一小段倒过来
音频变速六分钟的讲解想四分钟听完0.25x 到 4x,保持音调走波形拼接算法
音频变调伴奏的调不合你的嗓子-12 到 +12 半音,时长一点都不变
音频压缩文件太大,发不出去语音 64 kbps、播客 96 kbps、音乐 192 kbps、高音质 320 kbps 四档预设
在线录音手边只有麦克风,没有现成文件暂停继续、实时电平表、可切换输入设备
视频提取音频素材是 MP4、MOV 或 WebM从视频容器里取音轨;MKV、AVI 这类浏览器解不了的封装会直接提示
去除静音录音里停顿太多,想把空白吸掉静音阈值 -70 到 -20 dB、最短静音 0.1 到 3 秒、每段保留 0 到 0.5 秒,首尾静音一起删
添加混响干声太贴脸,想要点空间感小房间 0.6 秒、大厅 2.4 秒、教堂 4.5 秒、板式 1.4 秒四档预设,湿声 0 到 100%
双声道转单声道要单声道成品,或者左右声道互相打架合并取平均、只留左、只留右、左右互换、拆成两个文件
蒸汽波生成器想要那种拖慢变闷的复古听感速度 0.6 到 1.0x、低通 1000 到 12000 Hz、混响 0 到 80%,三件事在一次离线渲染里做完
音频加速做短视频里那种加速版1.05x 到 2.5x,默认同时升调,取消勾选就只加速

顺序上我一般先把没用的部分剪掉,再拉平音量,压到目标码率就收手,后面的处理和导出都会快一些。同一段素材想连着做两件事,接力比在一个页面里堆参数省事:去除静音把停顿吸掉,时长短了,再进音频压缩,出来的文件也跟着小。

有两件相邻的事这一箱工具不管:录音只想换一个人的音色,去语音转换;需要带时间轴的字幕文本,用字幕生成。

几个常见误解

  • “不上传会不会不安全”:反了。文件根本没出过本机,服务器那边没有副本可留,这类本地处理在隐私上通常比走服务器省心。
  • “导出的 MP3 和原文件一模一样”:不一样。MP3 是有损格式,128 kbps 和 320 kbps 的差别在好一点的耳机上能听出来,想要一致就导 WAV。
  • “浏览器工具只能处理几秒钟的片段”:不是。几十分钟的素材可以正常跑完,真正的边界是本机内存,两小时以上要谨慎。
  • “转成单声道,体积一定小一半”:只对了一半。左右声道内容不同的立体声文件在 WAV 下大致减半;本来就是单声道的文件,转完大小不变。
  • “去除静音会把换气声也切掉”:不会。它按 10 毫秒一窗扫音量,比设定时长更短的停顿一律不动,默认最短 0.35 秒,字与字之间的空隙多半能留下。
  • “蒸汽波就是慢放”:不止。拖慢的同时音调跟着降,还要过一遍低通和一段 2.6 秒的空间混响;磁带抖晃和底噪它不做。
  • “音量放大就是把声音调大”:只有一半对。它还能做峰值归一化和限幅,防止最响那一下爆掉,爆掉的采样点救不回来。
  • “录音页面会把我的声音传走”:不会。麦克风的音频流进页面之后留在本机内存,导出时才编码成文件。

常见问题

都不需要注册,也不需要登录。打开这一页挑工具就能用,处理全程在你自己的浏览器里完成,解码、运算、编码都在本机跑完,没有账号一样能把处理好的文件下载到本地。
整个流程里只有页面本身和那个约 120KB 的 MP3 编码脚本走网络,你的音频不参与任何请求,服务器收不到音频,也收不到文件名。想自己验证就导入文件后打开开发者工具的网络面板,处理期间不会出现上传文件的请求。
看手上是什么文件、想解决什么问题。掐长度用音频剪辑,换封装用音频格式转换,几段拼一条用音频合并,声音忽大忽小用音量放大,录音停顿多用去除静音,文件太大用音频压缩,想要复古听感用蒸汽波生成器。完整的对照在页面上方那张表里。
常见的是 MP3(32 到 320 kbps)和 WAV(16 位或 24 位),WebM(Opus) 与 OGG(Opus) 看浏览器支持。能导出哪几种由你的浏览器决定,Safari 上还能多导一个 M4A。
是三件不同的事。工具箱加工的是你手上已经有的音频文件,做剪辑、转换、压缩这类处理;站内的语音转换是把一段录音换成另一个音色,字幕生成是把音频或视频转成带时间轴的字幕文本。工具箱里的倒放、蒸汽波、去除静音这些,那两页都没有。
可能中途失败。解码后的采样数据全部放在浏览器内存里,素材越长占用越多,两小时以上的音频在内存较小的设备上容易卡住或者导出报错。我的经验是单个文件控制在 200MB 以内,更长的先剪成几段分别处理,再用音频合并接起来。