免费人声分离与伴奏提取

把歌曲或视频中的人声与伴奏分开,分别试听和下载。先选一段试听,再决定是否处理全曲;文件始终留在你的设备上。

在本机处理 · 无需账号 · 不添加水印

选择歌曲或视频

另一条音轨中可能残留人声或乐器,处理也可能改变音色。下载前请试听。

需下载约 45 MB 的模型及处理库。录音始终留在本机。

浏览器允许时会缓存模型,但不会同时保存你的录音。

从一首歌中提取伴奏,也能单独保留人声

想练唱时弱化原唱,或单独听清一段演唱的咬字和节奏,可以先把混合音源分成人声与伴奏。DojoClip 在浏览器内运行 SCNet 模型,提供两条可分别播放和保存的音轨,无需安装桌面音频软件。

同一文件的两种结果各有用途:伴奏适合练唱、排练和原创短片的配乐准备;人声适合检查演唱细节、整理自己的歌曲小样,或作为后续剪辑素材。提取结果仍需试听确认,不保证完全消除另一条音轨的声音。

如何在线分离人声与伴奏

  1. 选择本地文件。 导入一段音频或带音轨的视频,确认不超过 3 分钟和 100 MiB。较长录音可以先用音频剪切工具截取需要的部分。
  2. 选片段试听。 首次使用先下载模型和处理库,随后选择试听起点,分离最长 15 秒。分别听人声与伴奏,检查你最在意的段落。
  3. 处理完整文件。 效果合适后再分离全曲。处理在本机进行,请保持页面打开;需要时可以取消。
  4. 选择保存方式。 下载人声或伴奏 WAV。输入为视频时,也可以选择视频输出,再决定用哪条音轨替换原音轨。

试听哪些细节,才知道结果是否适合使用

优先检查人声与乐器同时较响的副歌,再听一句歌词结束后的尾音。伴奏中的模糊歌声、残留和声和混响,往往在这些位置更容易发现。单独听人声时,留意齿音、换气,以及鼓点或吉他是否混入。

尽量使用手头音质较好的原文件,避免为了分离而反复压缩。混响较重、现场环境复杂或多个人声叠唱的录音,结果可能与预期不同。保留原文件,方便比较和重新处理。

视频里的歌曲,选择音频或视频输出

如果只需要音乐素材,选择仅音频即可得到人声与伴奏 WAV,不必另外导出视频。如果需要保留画面,处理完整文件后选择人声或伴奏作为视频音轨。视频导出会保留原画面,不会自动生成歌词或字幕;输出 MP4 还是 WebM,取决于源视频和可用的处理支持。

语音录音中的风扇声、底噪和嘶声属于另一类问题,可以用音频降噪工具处理。准备练唱视频时,还可以添加字幕,或制作音乐可视化视频。更多单项编辑功能见免费工具。

人声分离常见问题

人声分离需要上传歌曲或注册吗?

不需要。文件在浏览器本地处理,免费使用且无需账号。首次使用会下载约 45 MB 的 SCNet 模型和所需处理库;下载模型不等于上传歌曲。浏览器允许时,模型会缓存供下次使用。

支持多长、多大的音频或视频?

单个文件最长 3 分钟、最大 100 MiB。可选择浏览器能解码的音频,以及包含可解码音轨的视频。是否能读取某个 MP3、WAV、M4A 或视频文件,取决于它的实际编码和浏览器支持。

能先试听歌曲中间的片段吗?

可以。选择试听起点后,工具会分离从该位置开始最长 15 秒的片段。建议挑有人声和乐器同时出现的部分。试听只处理选定片段;要下载完整音轨或替换视频音轨,还需要处理完整文件。

可以下载人声和伴奏吗?为什么 WAV 比 MP3 大?

两条音轨都能单独下载,格式为 44.1 kHz 立体声、32 位浮点 WAV。WAV 不采用 MP3 那样的压缩,因此体积通常更大,适合继续剪辑。播放器或编辑器需要支持浮点 WAV。

视频可以只导出音频,也可以保留画面吗?

可以。选择仅音频可下载两条 WAV;选择视频后,可用人声或伴奏替换主音轨,保留原画面,导出兼容的 MP4 或 WebM。视频导出不加 DojoClip 水印;附加音轨和独立字幕轨不会一并保留。

去除人声后,伴奏里为什么还能听到歌声?

分离结果是模型的估计。混响、和声以及人声和乐器的重叠可能造成残留、细节缺失或不自然的声音。请先试听主歌和副歌,不要把分离结果当作原始录音棚分轨。

能分别提取鼓、贝斯,或分开两个歌手吗?

当前工具提供人声和伴奏两条音轨,不提供鼓、贝斯等独立乐器轨,也不按歌手或说话人分轨。处理采访、旁白中的背景杂音时,应使用音频降噪工具。

为什么需要等待,手机也能用吗?

分离会使用设备的处理器和内存,速度因录音长度和设备而异。建议使用较新的桌面浏览器,并先做片段试听。手机能否完成取决于可用资源,不能保证所有机型都支持。处理时保持标签页打开,并在离开前下载结果。

免费人声分离:提取伴奏与人声,无需上传 | DojoClip