#52 · 主分类: 语音合成与识别
pyAudioAnalysis
audio
audio-analysis-tasks
audio-data
machine-learning
pyaudioanalysis
python
signal-processing
Python音频分析库:特征提取、分类、分割及应用
项目最后更新:08/04/25
GitHub Stars
6.3K
Forks数量
1.2K
贡献者数量
28
许可证
Apache-2.0
收录理由
原始音频往往难以直接利用,必须从中提取出结构信息才有价值,而pyAudioAnalysis把这类工作的大部分都收进了一个库里。它既能计算常见的MFCC、频谱图等特征,也提供了训练和评估音频片段分类器的成套流程,把标注好的WAV文件按文件夹放好,几行代码就能得到一个能用的声音识别模型。除了常规分类,它还能检测音频事件、剔除长录音中的静音段,既支持有监督的分段,也支持无监督的说话人分离,处理播客、会议或野外录音时,这很适合作为预处理的一环。做语音或环境声音相关管线的人,借助命令行封装和wiki里的示例,能很快看到结果;做研究的人也常把它当作音频分析工作的参照实现。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。