#163 · 主分类: 语音合成与识别

CTCWordBeamSearch

ctc decoder handwritten-text-recognition language-model recurrent-neural-networks speech-recognition text-recognition

连接主义时间分类(CTC)解码器,支持词典和语言模型。

项目最后更新:01/31/26

GitHub Stars

579

Forks数量

160

贡献者数量

3

许可证

MIT

收录理由

许多基于CTC的识别器默认采用贪心解码或普通束搜索,容易产生拼写错误或超出词表的文本。这个解码器则不同,它只从你提供的词典中选取单词,并用基于你自己语料训练的语言模型对候选序列排序,因此最终输出的文本始终限定在已知词汇范围内。对于语音转写和手写表单识别这类有效词集已经确定的场景,它非常契合。该Python包安装简单,测试也能顺利通过,README里还给出了一个最小示例,清楚演示了如何输入模型的概率矩阵并取回解码后的字符串。如果你正在构建识别系统,想省去后期纠错的麻烦,这个组件可以直接拿来用。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目