#163 · 主分类: 语音合成与识别
CTCWordBeamSearch
ctc
decoder
handwritten-text-recognition
language-model
recurrent-neural-networks
speech-recognition
text-recognition
连接主义时间分类(CTC)解码器,支持词典和语言模型。
项目最后更新:01/31/26
GitHub Stars
579
Forks数量
160
贡献者数量
3
许可证
MIT
收录理由
许多基于CTC的识别器默认采用贪心解码或普通束搜索,容易产生拼写错误或超出词表的文本。这个解码器则不同,它只从你提供的词典中选取单词,并用基于你自己语料训练的语言模型对候选序列排序,因此最终输出的文本始终限定在已知词汇范围内。对于语音转写和手写表单识别这类有效词集已经确定的场景,它非常契合。该Python包安装简单,测试也能顺利通过,README里还给出了一个最小示例,清楚演示了如何输入模型的概率矩阵并取回解码后的字符串。如果你正在构建识别系统,想省去后期纠错的麻烦,这个组件可以直接拿来用。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。