#16 · 主分类: 语音合成与识别
kaldi
kaldi-asr/kaldi 是 Kaldi 项目的官方仓库。
项目最后更新:09/22/25
GitHub Stars
15.5K
Forks数量
5.4K
贡献者数量
511
许可证
Other
收录理由
Kaldi 是语音研究领域许多人入门时接触的第一套工具包,即便到今天,它依然能胜任不少新框架覆盖不到的生产任务。整个流程都用 C++ 写成,从特征提取、基于 GMM 和神经网络的声学模型训练,到有限状态转换器解码,再到说话人识别与验证,全部以命令行程序形式提供,脚本化调用非常干净。它最突出的地方在于附带的示例配方,能一步步带你从原始音频语料走到可用的识别系统,适合真正理解 ASR 原理,而不是把它当黑盒。Apache 许可证和模块化设计让很多商业系统在它之上构建,其中的解码器和矩阵库等部分至今仍被新工具包沿用。如果你需要训练自定义声学模型、把现有模型适配到新语言或新领域,或者做说话人识别,Kaldi 都是一个扎实且文档完善的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。