从上传到下载,全程不到两分钟。这是支撑制作伴奏运作的技术与流程。
拖放文件,或点击浏览。支持 MP3、WAV、FLAC、M4A、AAC、OGG、AIFF、WMA、Opus 等格式(最大 100 MB),也支持 MP4、MOV、MKV、AVI、WebM、FLV、WMV、MPG、3GP 等视频文件(最大 1 GB)——我们会自动提取音轨。
我们的 GPU 加速 AI 模型会分析频率模式,将人声层从音乐中分离出来。
下载高品质 256 kbps MP3 格式的人声音轨和伴奏音轨。
制作伴奏 采用最先进的深度学习模型来实现音乐音源分离,它使用一种混合架构,结合了以下几个部分:
该模型基于成千上万首经过专业混音的多轨录音训练而成,能够识别并分离出各种曲风、各种制作风格中的人声特征。
旧方法的原理是:将伴奏音轨的相位反转,再与原曲混合抵消。但这只有在拥有完全一致的官方伴奏时才有效——而这种伴奏几乎不可能获得。
现代 AI 技术只需要一份混音后的音频文件即可运作,不需要伴奏音轨。神经网络凭借学习到的音频特征来分离人声——无需任何参考音轨。
上传的文件会被解码为标准化的音频流,确保无论输入格式如何,都能保持一致的音质。
音频会被发送到运行 AI 模型的 GPU 服务器上。借助 GPU 加速,处理一首 3 分钟的歌曲大约只需要 30 到 60 秒。
分离出的音轨会被编码为 256 kbps 的 MP3 格式,以获得最佳的兼容性和音质。人声音轨和伴奏音轨都会准备好供您下载。
下载链接会附带限时访问令牌生成。处理完成后,您可以立即访问自己的文件。
AI 人声分离的效果已经相当出色,但它并非魔法。以下是您可以预期的效果: