免费文字转语音 - 浮云梦配音
智能问答

在线剪辑音频(剪切 MP3 片段)

音频剪辑在浏览器里完成:波形拖选精确到毫秒,淡入淡出 0–10 秒,导出 MP3 或 WAV。文件不上传服务器,也不用注册登录。

适合这几件事:剪掉录音开头三秒的咳嗽、从 40 分钟的采访里截出 30 秒金句、给手机铃声切出副歌那一段。选区的开始和结束时间能直接打字输入,写成 00:01:23.450 这样,比拿鼠标一路对齐省事。剪完可以只导出选中部分,也能把选区静音、留一段空白。

我头一回剪一段 18 分钟的访谈,鼠标拖了三次都没卡住那句 8 秒的话,索性改在时间框里敲毫秒数,一次就准了。现在我的流程是先粗拖定个大概位置,再回到输入框里改数字。剪长音频全程占本机内存,两个小时以上的文件在小内存设备上有跑不动的可能,单个文件超过 200MB 我也得先看看这台机器还剩多少内存。

🎁 全员免费 🔒 文件不上传,全部在你的浏览器里处理

本地处理剪辑全程在你自己的浏览器内存里跑,音频文件不会上传到服务器,我们也看不到、留不下你的录音。关掉标签页,页面里就什么都不剩了。
格式与限制读文件靠的是浏览器的解码能力,MP3、WAV、OGG、FLAC、M4A/AAC、WebM 这些常见格式一般都能进;写文件同样看浏览器,MP3 和 WAV 一定出得来,WebM(Opus)、OGG(Opus) 不一定,Safari 上还能导 M4A。处理长音频吃内存,单个文件建议控制在 200MB 以内。
合法使用请确认你有权处理这段音频。剪切动作本身不改变版权归属,这一页也不会替你做版权判断。
全员免费
🎵

把文件拖到这里,或者点击选择文件

支持 MP3 / WAV / OGG / FLAC / M4A / AAC 等常见格式;文件不上传,全部在你的浏览器里处理

00:00 / 00:00

写 12.5 或 00:12.500 都行,精确到毫秒

留空等于一直取到文件末尾

在波形上按住拖动就能拉出选区,也可以用上面的时间输入框微调。淡入淡出用等功率曲线,接缝处不会出现啪的一声。

不用写扩展名,导出时按所选格式自动补上

本工具累计服务 28 次 今天 4 次 已导出 0 次 全部工具累计 296 次

怎么用:4 步完成

  1. 导入音频点“选择文件”或把音频拖进页面。MP3、WAV、OGG、FLAC、M4A/AAC、WebM 这些浏览器能解码的格式都能读,部分 MP4、MOV 里的音轨也能解出来。
  2. 在波形上拖出选区拖动波形上的两个把手圈出要保留的片段,也可以直接在开始、结束框里输入 00:00:12.340 这种毫秒级时间,两种方式混着用也行。
  3. 给切点加淡入淡出选区两端各设 0.3 到 1 秒的等功率淡入淡出,剪口就不会出现“咔”的爆音。淡入淡出时长上限是 10 秒。
  4. 导出剪好的音频选 MP3(32、64、96、128、160、192、256、320 kbps 八档)或 WAV(16 位/24 位)。头一回导出 MP3 会先加载约 120KB 的编码脚本,脚本没加载成功时页面会提示改用 WAV。

音频剪辑能剪什么,剪不了什么

剪切这件事本身很朴素:留下选区里的声音,丢掉其余部分。真正麻烦的是找时间点。

  • 剪插播:一期 52 分钟的播客里有两段 40 秒口播,切掉之后导出成一个 MP3。
  • 做铃声:从一首 3 分 40 秒的歌里截副歌那 25 秒,两端各加 0.5 秒淡入淡出,来电时不会一上来就炸耳朵。
  • 清理录音:手机录的会议开头有 4 秒桌椅响,剪掉再重新导出。
  • 备素材:把一段 10 分钟的环境音切成 3 个 20 秒小段,后面按需拼。

剪不出来的部分也直说:它不会自动识别静音段,不能按人声切句,不做降噪、去混响和音质修复。想按说话内容自动分段,得先把音频丢给字幕生成转出时间轴,再把时间点搬回来。

选区、淡入淡出与导出参数对照

参数不多,列成一张表更好查:

参数可选范围说明
选区时间精确到毫秒开始、结束框可以直接输入 00:01:23.450 这种写法
淡入/淡出0–10 秒等功率曲线,两段声音对接处不爆音
导出 MP332/64/96/128/160/192/256/320 kbps八档码率,头一回导出先加载约 120KB 编码脚本
导出 WAV16 位或 24 位体积偏大,适合还要继续加工的素材
其它导出格式WebM(Opus)、OGG(Opus),Safari 上可导 M4A能导出哪些格式由你的浏览器决定
处理位置你的浏览器内存文件不上传服务器
单文件体积建议 200MB 以内建议值,不是硬性上限,超长音频吃内存

我剪音频时的两个习惯

我会先把整段音频从头听到尾,在本子上记下要动的时间点,再开始拖波形。多花几分钟,比对着波形来回试选区省时间,尤其是 30 分钟以上的访谈。

另一个习惯是给切点多留 0.2 秒。人说话前那一下吸气剪得太干净,听着反而假。我截金句时会在句子前留 0.2 秒,导出后连起来顺得多。

音量偏差我不在这一页解决。剪出来的片段忽大忽小,交给音量调节那一页做峰值归一化更省事。

边界与限制:这一页做不到的事

三条限制得写清楚,免得你白等。

  • 解码和导出都靠浏览器。IE 和早期版本打不开这一页;Chrome、Edge、Firefox 新版给的导出选项比 Safari 多。
  • 内存是天花板。两小时以上的音频在小内存设备上有失败的可能,单个文件建议别超过 200MB。
  • 只做时间轴上的剪切,不碰音质。降噪、去混响、修削波都不在能力范围内,导出的音质上限就是你导入的那份文件。

还有一条不属于技术问题:版权。工具不会判断你手上这段录音能不能剪、能不能发。

常见问题

会。没被选中的部分被丢掉,剩下的首尾直接相接,导出就是一段连续音频。如果两段声音差别大,接缝听着突兀,给后一段的开头加 0.3 秒淡入会自然一些。
切点正好落在波形振幅大的位置,硬切就会有爆音。给选区两端各加 0.05 到 0.5 秒淡入淡出,这个声音基本就没了。等功率曲线对语音和音乐的接缝都算友好。
几秒就够。解码和导出都在这台机器上跑,文件越小越快。真正花时间的是把大文件读进内存那一步,我拿一段 1 小时的 WAV 试过,光等它解码就花了不少工夫。
不用装。MP3 由页面里的编码脚本直接生成,码率有 32 到 320 kbps 八档可选。脚本加载失败时改用 WAV 导出,文件一样能用。
能。开始和结束两个输入框接受“时:分:秒.毫秒”的写法,比如 00:02:14.780,粘进去确认就跳到那个位置。在 32 分钟的长音频里找一句 6 秒的话,我基本全靠手输。
它不做自动静音检测、不按人声切句、不降噪、不做音质修复,也不判断版权。想按说话内容自动分段,先用字幕工具转出带时间轴的字幕,再把时间点搬回这一页剪。