#52 · 主分类: 语音合成与识别

pyAudioAnalysis

audio audio-analysis-tasks audio-data machine-learning pyaudioanalysis python signal-processing

Python音频分析库:特征提取、分类、分割及应用

项目最后更新:08/04/25

GitHub Stars

6.3K

Forks数量

1.2K

贡献者数量

28

许可证

Apache-2.0

收录理由

原始音频往往难以直接利用,必须从中提取出结构信息才有价值,而pyAudioAnalysis把这类工作的大部分都收进了一个库里。它既能计算常见的MFCC、频谱图等特征,也提供了训练和评估音频片段分类器的成套流程,把标注好的WAV文件按文件夹放好,几行代码就能得到一个能用的声音识别模型。除了常规分类,它还能检测音频事件、剔除长录音中的静音段,既支持有监督的分段,也支持无监督的说话人分离,处理播客、会议或野外录音时,这很适合作为预处理的一环。做语音或环境声音相关管线的人,借助命令行封装和wiki里的示例,能很快看到结果;做研究的人也常把它当作音频分析工作的参照实现。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目