#9 · 主分类: 语音合成与识别
spleeter
Deezer 源分离库,包含预训练模型。
项目最后更新:06/18/26
GitHub Stars
28.4K
Forks数量
3.1K
贡献者数量
22
许可证
MIT
收录理由
做音乐相关工作的人,迟早会撞上这样的需求:想要一段录音里的人声,却不要伴奏;或者想把鼓点单独拎出来。Spleeter 就是 Deezer 开源的分离工具,靠预训练好的 TensorFlow 模型干活,从最简单的人声和伴奏二轨拆分,到能把鼓、贝斯、钢琴都单独分出来的五轨版本,都能应付。速度也够快,在 GPU 上处理一首歌,比实时播放还要快上百倍。用起来很灵活,命令行直接跑,或者当 Python 库嵌进自己的处理流程,再不然用 Docker 包起来,塞进批处理任务或者做个在线服务都不费劲。如果你手里有分轨好的音频素材,它还能让你训练自己的分离模型,所以既是个拿来就能用的现成工具,也是做定制化改造的好底子。二轨和四轨的模型在 musdb 基准上表现不错,说明分离出来的音质是靠谱的。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。