#80 · 主分类: 语音合成与识别

ClearerVoice-Studio

audio bandwidth-extension deep-learning noise-suppression pytorch speaker-extraction speech speech-enhancement speech-quality-evaluation speech-separation speech-super-resolution

一个由AI驱动的语音处理工具包和开源SOTA预训练模型,支持语音增强、分离和目标说话人提取等。

项目最后更新:08/14/25

GitHub Stars

4.5K

Forks数量

365

贡献者数量

11

许可证

Apache-2.0

收录理由

语音模型拿到的音频很少是干净的。这个工具箱把常见的音频修复工作集中到了一起:压制背景噪音、分离重叠人声、修复低带宽或低分辨率录音、从嘈杂轨道中提取目标说话人。核心包用 pip 就能安装,模型直接接收和返回 NumPy 数组,方便接进已有的 Python 训练或推理流程,不必绕道图形界面。研究者能拿到重训和微调脚本,还有生成带噪或带混响训练数据的工具;普通用户可以先试试在线演示再决定用哪个模型。想在语音处理上少走弯路,又不想自己拼装算法,这是个省事的现成选择。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目