人声分离器(免费)——在浏览器里做伴奏和卡拉OK

核心要点 (BLUF): 人声分离器直接在浏览器里把音轨分成两部分:人声和伴奏。上传一首歌,按下按钮,就能得到单独的人声和卡拉OK伴奏:两条音轨都能在页面上试听,并下载成 WAV 文件。文件不会上传到任何地方,全部在你的设备上处理,不消耗代币,这里也没有付费 API。视频文件同样可以——工具会从中取出声音。

人声分离能做什么,什么时候用得上

它把一首音乐拆成单独的声部。输入一首歌,输出两条音轨:单独的人声,以及伴奏——没有人声的版本。当你需要卡拉OK伴奏、想剪掉人声自己唱、做混音,或者只是想听听没有人声的编曲是什么样时,这个工具就派上用场。

单独抽出来的人声本身也有用:可以当参考、放进剪辑里,或者按乐句拆开研究。

工作原理:一首歌分出两条音轨

模型把音轨拆成四个声部:鼓、贝斯、其他和人声。页面上给你两条音轨:人声原样取出,伴奏则由除人声以外的所有声部合成。这样伴奏听起来是完整的,而不是几件乐器拼起来的碎片。

结果以 44.1 kHz 立体声 WAV 文件给出——可以直接在页面上试听并下载。

全部在你的设备上处理

音轨不会离开你的电脑:文件和做好的音轨都不会发送到任何地方。模型加载到浏览器里,在你的硬件上运行:计算走 WebGPU,如果显卡不可用,引擎会老老实实切到 CPU 并提醒你:那样会明显更慢。

分离不消耗代币:这是一个在你的设备上运行的免费工具,而不是在我们的服务器上。

哪些文件可以用

音频:MP3、WAV、M4A、OGG、FLAC 以及其他常见格式。也可以上传视频文件——工具会从中取出音轨。

工具在较新的 Chrome、Edge 或 Safari 里效果最好。在没有 WebGPU 的浏览器里,分离会走 CPU:同样能用,只是更慢。

第一次使用前需要知道什么

第一次运行时,浏览器会下载一次模型权重:大约 172 MB。它们会留在浏览器缓存里,之后再运行就能立刻开始。

时间取决于音轨长度和设备性能:短片段分离很快,长歌需要更久。进度会显示在进度条上,任务也可以取消。

常见问题

我的音轨真的不会上传到服务器吗?

是的。模型和它的权重会加载到浏览器里,计算在你的设备上进行。音轨本身和做好的音轨都不会发送到任何地方——这个工具根本没有付费 API。

分离要花多少钱?

不花钱。不消耗代币:这是一个在你的电脑上计算的免费工具。

我会得到哪几条音轨?

两条:单独的人声和伴奏——没有人声的版本。两条都能在页面上试听,并下载成 WAV 文件。

可以分离视频文件吗?

可以。工具会从视频里取出音轨,像普通音轨一样分离。

为什么第一次运行很慢?

浏览器要下载一次模型权重:大约 172 MB。之后就从缓存里读取,运行立刻开始。

没有 WebGPU 怎么办?

工具会继续在 CPU 上工作:更慢,但结果一样。它会自己提醒你已启用备用模式。