#121 · 主分类: 语音合成与识别

julius

audio-processing recognition speech speech-recognition

开源大词汇量连续语音识别引擎

项目最后更新:06/16/25

GitHub Stars

1.9K

Forks数量

304

贡献者数量

10

许可证

BSD-3-Clause

收录理由

Julius 是一款历史悠久的开源大词汇量连续语音识别解码引擎,自1997年在日本启动开发,至今仍具备实用价值。它并非开箱即用的完整识别产品,而是需要你自行准备标准 ARPA 和 HTK 格式的模型,引擎本身负责实时两遍解码,结合词 N-gram 与上下文相关 HMM,近年版本也加入了基于 DNN 的解码支持。它的运行环境非常灵活,从单片机到服务器都能跑,而且体积小、模块化程度高,适合嵌入到自己的系统里。最吸引人的地方在于它给了使用者极大的控制权:搜索参数可调,能输出词图和混淆网络,支持强制对齐、置信度评分,还有服务器模式和简洁的库接口。对于想深度定制识别流程、而不是依赖云端服务的开发者或研究人员来说,Julius 是很好的选择。需要坦诚说明的是,2020 年发布后项目维护节奏明显放缓,所以更适合在稳定、较旧的代码基础上进行二次开发。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目