这款人声分离工具做不到的事
这是中间声道抵消运算,不是源分离模型,依赖它之前值得了解它真实的局限。
需要居中且较干的人声
它在老歌或混音简单的录音上效果最好。如果现代混音把主唱人声加宽、做了双轨叠加,或加了很重的混响,就无法干净地抵消,留下的只是一层更弱的人声残影,而不是完全消失。
被抵消的不只是人声
这项技术并不知道什么是人声。任何放在正中间的内容,例如军鼓或居中的主奏乐器,都会跟人声一起被减掉。只有 120 Hz 以下的内容会被保护。
提取出的人声不是干净的干音
提取出的人声文件其实是 120 Hz 以上的混音中间部分,其中既包含人声,也包含其他居中的内容。它适合用来跟唱歌词或旋律,但不能当作干净的人声轨道使用。
单声道播放会削弱效果
手机扬声器或单声道音箱会把左右声道重新叠加在一起,这会让被抵消的内容重新出现,并削弱伴奏音轨,在强度较高时尤其明显。
不是源分离模型
经过训练的源分离模型能更好地处理现代、混响较重的混音,还能生成真正按乐器分离的音轨。这类模型所需的算力远超一个浏览器标签页,而且大多数网页版本会把您的音频上传到服务器处理。
相关工具
常见问题
是的。工具会抵消左右声道共有的信号,因此单声道文件没有可比较的两个声道,会直接提示错误,而不是悄悄处理。
不会。消除强度只改变从伴奏音轨中减去多少中间信号。提取出的人声文件始终是 120 Hz 以上的完整中间信号,无论滑块设在哪里。
不是。它是中间声道抵消运算,依靠 Web Audio API 完成的算术运算,没有模型、没有训练数据,除了页面本身也不需要下载任何东西。
通常只能部分有效。它在老歌或混音简单、人声居中且较干的录音上效果最好。如果混音把主唱人声加宽、做了叠加,或加了很多混响,留下的会是一层人声残影,而不是完全消失。
因为 120 Hz 以上所有居中的内容都会被去掉,不只是人声。居中的军鼓或主奏乐器也会跟着一起消失。调低强度会保留更多原始混音,但代价是也会保留更多人声。
不会。解码、中间声道运算和 WAV 编码全部在这个标签页内通过 Web Audio API 完成,不需要下载任何库。
文件始终留在您的设备上
浏览器会在这个标签页内解码歌曲并完成中间声道运算,不会上传任何内容,也不需要下载任何库:分离过程只使用浏览器内置的 Web Audio API。