#46 · 主分类: 自然语言处理与文本处理
gse
Go 高效多语言 NLP 和文本分词;支持英语、中文、日语等。
项目最后更新:06/10/26
GitHub Stars
2.8K
Forks数量
232
贡献者数量
8
许可证
Apache-2.0
收录理由
Gse 把 jieba 的分词思路带到了 Go 生态里,对于需要在同一套代码中同时处理中文、日文和英文文本的场景,它提供了基于词典的切分能力,省去了额外运行 Python 服务的麻烦。它支持精确、通用、搜索引擎、全模式和 HMM 等多种分词模式,其中 Viterbi 算法能识别词典中未收录的词,这在面对 CJK 输入时是常见痛点。项目还提供了连接 Elasticsearch 和 Bleve 的适配器,让已经基于这些索引做多语言内容检索的团队,能够把分词逻辑直接放在数据链路附近。作为一个库而非独立服务,Gse 很适合那些希望把 NLP 能力直接嵌入自身业务服务的项目,部署和调用都更轻量。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。