#157 · 主分类: 自然语言处理与文本处理
neuspell
NeuSpell:神经拼写纠正工具包
项目最后更新:07/31/23
GitHub Stars
714
Forks数量
106
贡献者数量
6
许可证
MIT
收录理由
NeuSpell 是一个面向研究场景的拼写纠正工具包,它把十种神经拼写纠正模型统一封装在同一个 Python 接口里,你可以在 CNN-LSTM、SC-LSTM 和基于 BERT 的检查器之间自由切换,而无需改动流水线的其他部分。这些模型既用真实拼写错误训练,也用了合成噪声数据,处理日常输入中的错别字时,效果往往优于 Aspell 这类传统工具。工具包还附带生成合成拼写错误数据的工具,以及在自己的领域数据上微调检查器的能力,并提供了一个网页演示方便手动测试。你可以在运行过程中随时评估纠正准确率。如果你的文本处理流程经常遇到拼写错误,比如搜索查询或聊天消息,那么预训练好的模型权重,以及针对自定义词表进行适配的选项,会是使用频率最高的部分。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。