跳过主要内容
人声分离与伴奏提取

在线人声分离与伴奏提取

上传一首歌,人声分离会拆成伴奏床和人声轨。去掉人声做 karaoke,或只留人声做清唱提取——两条 WAV 都能下载。

分离在后台 GPU 队列上跑,等几分钟很正常;两条音轨就绪后这个标签页会更新。

人声分离怎么工作

四步,不用装软件。人声分离跑在 GPU 队列上,三分钟的歌不会把浏览器卡死三分钟。

01

上传混音

拖入 MP3、WAV、M4A、FLAC 或 OGG。人声分离在浏览器里读时长,免费档超过十分钟会直接拒绝,避免白等一个会被打回的作业。

02

排队分离

浏览器把文件直传到对象存储,再释放到人声分离模型,估计人声和伴奏。这不是合成,是对原曲做音源分离。

03

试听两条音轨

队列结束后有两个播放器。去掉人声听伴奏 karaoke 床;提取人声听清唱。先听再下。

04

下载 WAV

bg.wav 是伴奏提取结果,vocals.wav 是人声。第一版只出 WAV,没有额外转码,也没有意外码率。

为什么用这个人声分离

浏览器里的 karaoke 制作

从歌曲去掉人声,对着剩下的伴奏唱。这个 karaoke 制作不依赖曲库:你上传有权处理的混音,人声分离返回可播放的伴奏床。

清唱提取,不是均衡器

翻唱、mashup、叠和声时把人声单独提出来。清唱提取给出一条人声轨,不是靠挖频冒充人声分离。

给垫乐用的伴奏提取

播客、视频、排练需要垫乐?伴奏提取就是 bg.wav——karaoke 制作要的同一条床,没有主唱压在每个重拍上。

不用安装,不用 Python

别的人声分离工具要你本机跑 UVR、选模型、听风扇。这里就是一页:登录、上传、等队列、下载。GPU 在我们这边。

人声分离能做什么

在家练 karaoke

karaoke 制作只有在伴奏就是你想唱的那首歌时才有用。对已有曲目做人声分离,循环 bg.wav,直到副歌落在你的音域里。

给翻唱抽人声

需要原唱句读当导唱时用清唱提取。提出人声,把 vocals.wav 垫在自己的 take 下面,导出前再静音。

做伴奏 remix

伴奏提取给制作人一条能切的床。人声分离跑一次,留下 bg.wav,就不用在每个重拍上跟人声打架。

给口播清垫乐

播客和课程常要律动不要主唱。人声分离去掉人声,把伴奏垫在口播下面,只处理你确实有权用的素材。

人声分离常见问题

什么是人声分离?

人声分离是音源分离:从立体声混音里估计歌声,写出伴奏床和人声两条文件。CosyVoice 的人声分离在浏览器里完成。你上传曲目,作业在 GPU 队列上跑,然后下载 bg.wav 和 vocals.wav。它不是高通滤波,也不是歌词视频站,而是面向 karaoke、翻唱和垫乐的分轨工具。

怎么从歌曲里去掉人声?

要去掉人声,先登录并验证邮箱,拖入不超过十分钟的 MP3 或 WAV,再开始作业。人声分离上传文件、排队、返回可立刻播放的伴奏。那条伴奏就是 karaoke 制作的输出:拿来唱,或垫在口播下面。如果要反方向,同一份结果里用「提取人声」——一次上传两条都有。

这个 karaoke 制作也能提取人声吗?

能。同一次人声分离既是 karaoke 制作,也是清唱提取。去掉人声得到伴奏(bg.wav),提取人声得到清唱(vocals.wav)。上传前不用选模式,两条一起出,你可以先听再决定要哪条。

这是清唱提取还是伴奏提取?

都是。清唱提取留人声去乐队;伴奏提取留乐队去人声。这次人声分离一遍写出两条,所以结果是两栏而不是一个下载。要清唱用 vocals.wav,要伴奏或 karaoke 床用 bg.wav。

人声分离能上传哪些文件?

WAV、MP3、M4A、FLAC、OGG。视频容器不在本页范围——先抽出音频。人声分离在浏览器读时长,免费档超过十分钟不会开作业。第一版两条输出都是 WAV,暂不转 MP3。

人声分离要多久?

按分钟计,不是毫秒。分离是共享队列上的 GPU 作业,三分钟的歌通常是短等,不是立刻下载。页面轮询状态,不会锁死标签页。队列忙时会先看到排队和运行,然后才出现两个播放器。这对真人声分离是正常的,不是客户端均衡器。

每天能做几次人声分离?

免费账号每个 UTC 日可跑三次人声分离,单文件最长十分钟。够试一次 karaoke 制作、一次清唱提取,再留一次备用。额度用完后页面给出升级入口,而不是再开 GPU 作业。Pro 不受三次上限。必须登录且验证邮箱,没有匿名人人声分离。