人声分离需要上传歌曲或注册吗?
不需要。文件在浏览器本地处理,免费使用且无需账号。首次使用会下载约 45 MB 的 SCNet 模型和所需处理库;下载模型不等于上传歌曲。浏览器允许时,模型会缓存供下次使用。
把歌曲或视频中的人声与伴奏分开,分别试听和下载。先选一段试听,再决定是否处理全曲;文件始终留在你的设备上。
在本机处理 · 无需账号 · 不添加水印
选择歌曲或视频
另一条音轨中可能残留人声或乐器,处理也可能改变音色。下载前请试听。
需下载约 45 MB 的模型及处理库。录音始终留在本机。
浏览器允许时会缓存模型,但不会同时保存你的录音。
想练唱时弱化原唱,或单独听清一段演唱的咬字和节奏,可以先把混合音源分成人声与伴奏。DojoClip 在浏览器内运行 SCNet 模型,提供两条可分别播放和保存的音轨,无需安装桌面音频软件。
同一文件的两种结果各有用途:伴奏适合练唱、排练和原创短片的配乐准备;人声适合检查演唱细节、整理自己的歌曲小样,或作为后续剪辑素材。提取结果仍需试听确认,不保证完全消除另一条音轨的声音。
优先检查人声与乐器同时较响的副歌,再听一句歌词结束后的尾音。伴奏中的模糊歌声、残留和声和混响,往往在这些位置更容易发现。单独听人声时,留意齿音、换气,以及鼓点或吉他是否混入。
尽量使用手头音质较好的原文件,避免为了分离而反复压缩。混响较重、现场环境复杂或多个人声叠唱的录音,结果可能与预期不同。保留原文件,方便比较和重新处理。
如果只需要音乐素材,选择仅音频即可得到人声与伴奏 WAV,不必另外导出视频。如果需要保留画面,处理完整文件后选择人声或伴奏作为视频音轨。视频导出会保留原画面,不会自动生成歌词或字幕;输出 MP4 还是 WebM,取决于源视频和可用的处理支持。
语音录音中的风扇声、底噪和嘶声属于另一类问题,可以用音频降噪工具处理。准备练唱视频时,还可以添加字幕,或制作音乐可视化视频。更多单项编辑功能见免费工具。
不需要。文件在浏览器本地处理,免费使用且无需账号。首次使用会下载约 45 MB 的 SCNet 模型和所需处理库;下载模型不等于上传歌曲。浏览器允许时,模型会缓存供下次使用。
单个文件最长 3 分钟、最大 100 MiB。可选择浏览器能解码的音频,以及包含可解码音轨的视频。是否能读取某个 MP3、WAV、M4A 或视频文件,取决于它的实际编码和浏览器支持。
可以。选择试听起点后,工具会分离从该位置开始最长 15 秒的片段。建议挑有人声和乐器同时出现的部分。试听只处理选定片段;要下载完整音轨或替换视频音轨,还需要处理完整文件。
两条音轨都能单独下载,格式为 44.1 kHz 立体声、32 位浮点 WAV。WAV 不采用 MP3 那样的压缩,因此体积通常更大,适合继续剪辑。播放器或编辑器需要支持浮点 WAV。
可以。选择仅音频可下载两条 WAV;选择视频后,可用人声或伴奏替换主音轨,保留原画面,导出兼容的 MP4 或 WebM。视频导出不加 DojoClip 水印;附加音轨和独立字幕轨不会一并保留。
分离结果是模型的估计。混响、和声以及人声和乐器的重叠可能造成残留、细节缺失或不自然的声音。请先试听主歌和副歌,不要把分离结果当作原始录音棚分轨。
当前工具提供人声和伴奏两条音轨,不提供鼓、贝斯等独立乐器轨,也不按歌手或说话人分轨。处理采访、旁白中的背景杂音时,应使用音频降噪工具。
分离会使用设备的处理器和内存,速度因录音长度和设备而异。建议使用较新的桌面浏览器,并先做片段试听。手机能否完成取决于可用资源,不能保证所有机型都支持。处理时保持标签页打开,并在离开前下载结果。