#80 · 主分类: 语音合成与识别
ClearerVoice-Studio
audio
bandwidth-extension
deep-learning
noise-suppression
pytorch
speaker-extraction
speech
speech-enhancement
speech-quality-evaluation
speech-separation
speech-super-resolution
一个由AI驱动的语音处理工具包和开源SOTA预训练模型,支持语音增强、分离和目标说话人提取等。
项目最后更新:08/14/25
GitHub Stars
4.5K
Forks数量
365
贡献者数量
11
许可证
Apache-2.0
收录理由
语音模型拿到的音频很少是干净的。这个工具箱把常见的音频修复工作集中到了一起:压制背景噪音、分离重叠人声、修复低带宽或低分辨率录音、从嘈杂轨道中提取目标说话人。核心包用 pip 就能安装,模型直接接收和返回 NumPy 数组,方便接进已有的 Python 训练或推理流程,不必绕道图形界面。研究者能拿到重训和微调脚本,还有生成带噪或带混响训练数据的工具;普通用户可以先试试在线演示再决定用哪个模型。想在语音处理上少走弯路,又不想自己拼装算法,这是个省事的现成选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。