#121 · 主分类: 语音合成与识别
julius
开源大词汇量连续语音识别引擎
项目最后更新:06/16/25
GitHub Stars
1.9K
Forks数量
304
贡献者数量
10
许可证
BSD-3-Clause
收录理由
Julius 是一款历史悠久的开源大词汇量连续语音识别解码引擎,自1997年在日本启动开发,至今仍具备实用价值。它并非开箱即用的完整识别产品,而是需要你自行准备标准 ARPA 和 HTK 格式的模型,引擎本身负责实时两遍解码,结合词 N-gram 与上下文相关 HMM,近年版本也加入了基于 DNN 的解码支持。它的运行环境非常灵活,从单片机到服务器都能跑,而且体积小、模块化程度高,适合嵌入到自己的系统里。最吸引人的地方在于它给了使用者极大的控制权:搜索参数可调,能输出词图和混淆网络,支持强制对齐、置信度评分,还有服务器模式和简洁的库接口。对于想深度定制识别流程、而不是依赖云端服务的开发者或研究人员来说,Julius 是很好的选择。需要坦诚说明的是,2020 年发布后项目维护节奏明显放缓,所以更适合在稳定、较旧的代码基础上进行二次开发。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。