在线人声分离与伴奏提取
上传一首歌,人声分离会拆成伴奏床和人声轨。去掉人声做 karaoke,或只留人声做清唱提取——两条 WAV 都能下载。
分离在后台 GPU 队列上跑,等几分钟很正常;两条音轨就绪后这个标签页会更新。
人声分离怎么工作
四步,不用装软件。人声分离跑在 GPU 队列上,三分钟的歌不会把浏览器卡死三分钟。
上传混音
拖入 MP3、WAV、M4A、FLAC 或 OGG。人声分离在浏览器里读时长,免费档超过十分钟会直接拒绝,避免白等一个会被打回的作业。
排队分离
浏览器把文件直传到对象存储,再释放到人声分离模型,估计人声和伴奏。这不是合成,是对原曲做音源分离。
试听两条音轨
队列结束后有两个播放器。去掉人声听伴奏 karaoke 床;提取人声听清唱。先听再下。
下载 WAV
bg.wav 是伴奏提取结果,vocals.wav 是人声。第一版只出 WAV,没有额外转码,也没有意外码率。
为什么用这个人声分离
浏览器里的 karaoke 制作
从歌曲去掉人声,对着剩下的伴奏唱。这个 karaoke 制作不依赖曲库:你上传有权处理的混音,人声分离返回可播放的伴奏床。
清唱提取,不是均衡器
翻唱、mashup、叠和声时把人声单独提出来。清唱提取给出一条人声轨,不是靠挖频冒充人声分离。
给垫乐用的伴奏提取
播客、视频、排练需要垫乐?伴奏提取就是 bg.wav——karaoke 制作要的同一条床,没有主唱压在每个重拍上。
不用安装,不用 Python
别的人声分离工具要你本机跑 UVR、选模型、听风扇。这里就是一页:登录、上传、等队列、下载。GPU 在我们这边。
人声分离能做什么
在家练 karaoke
karaoke 制作只有在伴奏就是你想唱的那首歌时才有用。对已有曲目做人声分离,循环 bg.wav,直到副歌落在你的音域里。
给翻唱抽人声
需要原唱句读当导唱时用清唱提取。提出人声,把 vocals.wav 垫在自己的 take 下面,导出前再静音。
做伴奏 remix
伴奏提取给制作人一条能切的床。人声分离跑一次,留下 bg.wav,就不用在每个重拍上跟人声打架。
给口播清垫乐
播客和课程常要律动不要主唱。人声分离去掉人声,把伴奏垫在口播下面,只处理你确实有权用的素材。
人声分离常见问题
什么是人声分离?
人声分离是音源分离:从立体声混音里估计歌声,写出伴奏床和人声两条文件。CosyVoice 的人声分离在浏览器里完成。你上传曲目,作业在 GPU 队列上跑,然后下载 bg.wav 和 vocals.wav。它不是高通滤波,也不是歌词视频站,而是面向 karaoke、翻唱和垫乐的分轨工具。
怎么从歌曲里去掉人声?
要去掉人声,先登录并验证邮箱,拖入不超过十分钟的 MP3 或 WAV,再开始作业。人声分离上传文件、排队、返回可立刻播放的伴奏。那条伴奏就是 karaoke 制作的输出:拿来唱,或垫在口播下面。如果要反方向,同一份结果里用「提取人声」——一次上传两条都有。
这个 karaoke 制作也能提取人声吗?
能。同一次人声分离既是 karaoke 制作,也是清唱提取。去掉人声得到伴奏(bg.wav),提取人声得到清唱(vocals.wav)。上传前不用选模式,两条一起出,你可以先听再决定要哪条。
这是清唱提取还是伴奏提取?
都是。清唱提取留人声去乐队;伴奏提取留乐队去人声。这次人声分离一遍写出两条,所以结果是两栏而不是一个下载。要清唱用 vocals.wav,要伴奏或 karaoke 床用 bg.wav。
人声分离能上传哪些文件?
WAV、MP3、M4A、FLAC、OGG。视频容器不在本页范围——先抽出音频。人声分离在浏览器读时长,免费档超过十分钟不会开作业。第一版两条输出都是 WAV,暂不转 MP3。
人声分离要多久?
按分钟计,不是毫秒。分离是共享队列上的 GPU 作业,三分钟的歌通常是短等,不是立刻下载。页面轮询状态,不会锁死标签页。队列忙时会先看到排队和运行,然后才出现两个播放器。这对真人声分离是正常的,不是客户端均衡器。
每天能做几次人声分离?
免费账号每个 UTC 日可跑三次人声分离,单文件最长十分钟。够试一次 karaoke 制作、一次清唱提取,再留一次备用。额度用完后页面给出升级入口,而不是再开 GPU 作业。Pro 不受三次上限。必须登录且验证邮箱,没有匿名人人声分离。