想拿一段干净的acappella做remix采样?想对照原唱练习自己的演唱?还是想做一个"人声挑战"混剪?这些场景要的都不是伴奏,而是只留人声、去掉所有乐器的音轨——这正是人声提取这个工具专门要做的事。
和"人声消除"有什么不同?
制作伴奏其实用同一套 AI 分离模型支撑着三个不同的工具,区别只在于最终保留哪个 stem:
- 人声消除——只保留伴奏,去掉人声,做卡拉OK用。
- 人声提取(本文讲的这个)——只保留人声,去掉伴奏。
- 音频分离——两个都要,一次上传同时拿到人声和伴奏两个文件。
三个工具背后跑的是同一次 AI 运算,只是最后过滤保留哪个输出文件不一样——选你真正需要的那一个,省得下载了用不上的文件。
怎么提取人声
- 打开人声提取页面
- 上传歌曲——把 MP3、WAV、FLAC 等音频文件拖进上传区,也支持直接上传视频文件自动提取音轨
- 等待处理,一般 30~90 秒
- 下载人声音轨——纯净的人声文件,MP3 格式
提取出来的人声能用来做什么
- Remix / 采样——把提取出来的人声铺到自己新做的编曲上,做一版新的remix。
- 练习跟唱——对照原唱的咬字、气口、颤音细节反复练习。
- 翻唱对照——把自己的翻唱和提取出来的原唱人声放在一起对比找差距。
- 字幕/歌词校对——去掉伴奏后人声更清楚,方便逐字核对歌词。
获得更干净效果的技巧
- 源文件质量越高越好。320 kbps 或无损(FLAC/WAV)的输入,分离效果明显好于 128 kbps 的压缩文件。
- 人声层次分明的歌曲效果最好。编曲密集、乐器和人声频率大量重叠的曲风(比如厚重的金属乐、古典乐)分离难度更大。
- 如果提取出来的人声里还留有一点点乐器声,可以试试人声降噪再处理一遍,能进一步去掉一些残留的背景成分。
常见问题
提取出来的人声里会不会还带一点点伴奏?
有可能,尤其是编曲复杂、人声混响较重的歌曲。AI 分离效果已经很好,但不是百分之百完美——这是当前技术的真实局限,不是网站的 bug。
输出的是什么格式?
256 kbps 的高质量 MP3,绝大多数场景下音质和无损基本听不出区别。
可以直接把提取出来的人声拿去做remix发布吗?
个人练习和创作没问题,但如果涉及公开发布、商业用途,原曲的版权仍然归属原作者,需要获得相应授权。