浏览器音频剪辑教程:裁剪一段录音,再按时长切成多段
跟着 StemNook 的界面操作,设置音频起止时间、试听选区、下载 WAV,再把录音按固定时长拆成多段。配截图说明输入限制、常见报错和结果检查。

先看操作顺序: 打开音频裁剪工具,选择 MP3 或 WAV,填写开始、结束秒数,试听选区,再创建片段并下载 WAV。想拆成多个规律片段,就设置每段时长,对整份音频执行切段。
一段录音里,你只想分享中间的一句话,却把整份文件都发过去。接收的人还要拖进度条,反复找你说的那个位置。
我的建议是先做一个选择:这次只需要一段,还是需要把整份录音分成几段?StemNook 的浏览器编辑器同时有这两个入口,先选对任务,后面的操作就会清楚。
这篇教程使用 七秒的合成朗读演示音频来说明时间。它不是用户录音,也不是歌曲分离效果案例。
这次我保留 第 1 秒到第 3 秒,检查下载的 WAV,实际时长是 两秒。再把完整七秒按三秒一段拆开,得到 3+3+1 秒。这是本地剪辑检查,下面的截图记录每一步使用的控件。
下载七秒朗读演示 WAV,就能按截图操作;也可以换成你自己的录音。
1. 裁剪一段和拆成多段,分别怎么选
只要一段,就设置开始、结束时间,再点 创建片段,最终得到一个文件。
想按规律拆开完整录音,就设置每段时长,再点 切分文件。最后一段可以更短;这个功能不会自动寻找句尾、辨认说话人或检测静音。
| 你要完成的事 | 使用哪个操作 | 本文例子 |
|---|---|---|
| 保留一段回答 | 起止时间+创建片段 | 保留第 1 到第 3 秒 |
| 按顺序复习录音 | 每段时长+切分文件 | 七秒分成 3+3+1 秒 |
| 把歌声与伴奏分开 | 首页 AI 分离 | 是另一项云端操作 |
打开音频裁剪工具。这里在浏览器中处理音频,裁剪不需要把这份文件上传到处理服务器,也不要求登录账户。

“本地处理”说的是这个工具对音频文件的处理方式,不是说整个网站没有网络活动,也不能套用到首页 AI 分离上。
2. 先打开一份设备能处理的文件
选择有效的 MP3 或 WAV。界面上限是 30 MB、10 分钟,两项都需要满足。
还有一个解码后的内存限制。压缩文件在硬盘上很小,浏览器打开时也可能占用较多内存。因此,十分钟上限不代表任何十分钟音频都能在任何设备上打开。
手机吃力时,先尝试更短的文件,或换桌面浏览器。某一台设备处理不了,不一定说明原文件损坏。
文件打开后,核对名称、时长和声道。本文例子是七秒单声道音频,你的文件可能不同,起止时间要按工具实际显示的时长来设置。

波形可以帮助你看到声音强弱的变化,但它不是文字转写,不能直接告诉你这个位置说了哪个字、唱了哪句词。
3. 填写开始和结束秒数
本文例子把 开始(秒)设为 1,把 结束(秒)设为 3。
意思是从原音频第 1 秒开始,到第 3 秒结束。保留长度是 3-1=2 秒。结束框填写的是原文件中的位置,不是“想保留多长”。
你也可以调整对应的开始、结束滑杆。本文不依赖直接在波形上拖出选区的交互。
起止值支持小数秒。某个词不一定刚好从整数秒开始,可以细调,但最终还要试听,不能只凭小数位判断切点是否合适。

开始时间要早于结束时间,两者都要在原音频时长内。值不合理时,先改时间,不要连续点击创建。
4. 创建前,试听开头和结尾
点击 试听选区,重点听第一句话的开头和最后一个声音。有没有切掉一个字?有没有混进下一句话?
语音片段通常需要留一点空间。把切点放在最响的音节上,可能会削掉开头;结束太早,又会让一句话听起来没说完。
音乐还要检查节拍和乐器尾音。波形上一个看起来整齐的位置,不一定就是听起来顺畅的切点。
当前裁剪工具没有自动淡入淡出、静音检测,也不保证每个切点都不会有点击声。需要更细的边缘处理时,在具备相应功能的编辑器中完成。
改起止时间后,之前准备的片段列表会清空,避免你下载旧选区。核对最终数值,再创建一次片段。
5. 创建片段,下载实际 WAV 文件
点击 创建片段,结果行会显示选区的起止位置,并提供 下载片段 1。
出现结果行,代表已准备好导出。还需要点下载按钮,文件才会保存到你的设备;只选了时间,并不等于已经保存。

例子的下载名称以 -clip-1.wav 结尾。结果是 16-bit PCM WAV,采样率跟随浏览器解码后的音频,所以本文不把它固定写成所有设备都输出同一个采样率。
用你平时的播放器打开下载文件,检查时长是否约两秒,再听一遍两端。网页试听是创建前的检查,下载后的文件才是最后要使用的结果。
MP3 输入也会导出 WAV。这不是保留原 MP3 字节,下载后改扩展名也不会把 WAV 转成 MP3。
6. 把完整录音按固定时长切开
找到 需要多个片段?,在 片段长度(秒)中填 3,然后点击 切分文件。
完整七秒会得到:
| 片段 | 原音频区间 | 时长 |
|---|---|---|
| 1 | 0—3 秒 | 3 秒 |
| 2 | 3—6 秒 | 3 秒 |
| 3 | 6—7 秒 | 1 秒 |

按时长切段使用的是 整份原文件,不是之前设置的第 1—3 秒选区。最后一段只有一秒,是因为原录音已经结束。
当前每段需要单独下载,不会自动打包 ZIP。把有编号的文件名保留下来,可以更容易按顺序整理。
最多可生成 60 段。设置过短、导致段数超过上限时,调长每段时长。这是段数限制,不代表所有设备都能处理最大规模的文件。
固定时间会切过一个字或一个节拍。如果想得到一句完整的话,改用开始、结束时间,自己确认边界。
7. 常见问题先查这三项
文件打不开
检查 MP3/WAV、大小和时长。损坏的音频、浏览器无法解码,或解码后内存太大,都可能导致失败。先试一份较短的有效文件,再判断原因。
起止时间被拒绝
同时看开始和结束。开始填 5、结束填 3,无法构成向前的选区。错误画面说明的是这个情况,下一步是改正时间。

下载文件比预期大
PCM WAV 通常比 MP3 大,体积还受时长、采样率和声道数影响。缩短片段会减少音频量,但这个裁剪工具不是专门的压缩工具。
先保留一段有用的内容
拿一份你有权编辑的短音频,选好时间,试听,创建,再检查下载文件。熟悉这条流程后,再试着把整份录音拆成规律片段。
想分开歌声与伴奏,请去首页分离工作区。想理解按时长拆分,可以看音频切段内页预览;“stems”说的是另一种分轨含义,可以读分轨说明页。