#149 · 主分类: 语音合成与识别

pytorch-kaldi

asr deep-learning deep-neural-networks dnn dnn-hmm gru kaldi lstm lstm-neural-networks multilayer-perceptron-network pytorch recurrent-neural-networks rnn rnn-model speech speech-recognition timit

pytorch-kaldi是一个用于开发最先进的DNN/RNN混合语音识别系统的项目。DNN部分由pytorch管理,而特征提取、标签计算和解码则使用kaldi工具包完成。

项目最后更新:03/14/22

GitHub Stars

2.4K

Forks数量

442

贡献者数量

16

许可证

Other

收录理由

对于搭建HMM/DNN混合语音识别系统的研究者和工程师来说,这个工具包正好架在两个成熟生态之间:神经网络部分交给PyTorch,而特征提取、标签计算和解码则沿用Kaldi的成熟方案。你不必从零搭建声学管线,可以把精力集中在DNN结构上,借助Kaldi久经考验的数据准备与解码设施来推进实验。项目自带Timit等标准评测集的配置,复现论文结果和迭代模型设计都相当顺手。把它当作混合语音识别研究的一份参考实现和早期基石来看待比较合适。需要注意的是,维护者如今已明确引导用户转向他们的后继项目SpeechBrain,后者覆盖端到端识别以及更多语音任务,在基于这套代码开展新工作之前,这一点值得纳入考量。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目