#136 · 主分类: 语音合成与识别

vocal-remover

audio deep-learning pytorch segmentation spectrogram vocal-remover vocal-separation

基于深度神经网络的人声移除器

项目最后更新:07/23/24

GitHub Stars

1.8K

Forks数量

256

贡献者数量

9

许可证

MIT

收录理由

把一首歌拆成人声和伴奏,通常得折腾各种滤波插件,或者花钱用在线服务。vocal-remover 用 PyTorch 写了个命令行工具,核心是 U-Net 网络,本地就能跑:给一个音频文件,它直接输出两个 WAV,一个保留人声,一个保留伴奏。CPU 和 GPU 都能运行,加个 --tta 参数还能用测试时增强改善分离效果。仓库里也带了训练脚本,如果你有自己配对的混合音频和纯伴奏数据集,可以自己训练模型,不必依赖自带的权重。这个项目保持了一个聚焦脚本的样子,没做成大而全的工作站,所以丢进批处理任务或者更大的音频处理管线里很顺手。做播客剪辑或视频制作的人,如果只是想要一条干净的伴奏或人声分轨,这个工具实用又不花哨。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目