#117 · 主分类: 自然语言处理与文本处理

xmnlp

lexical-analysis ner nlp pinyin postagging radical segmentation sentence-embeddings sentence-similarity sentiment-analysis spell-checker

xmnlp:提供中文分词, 词性标注, 命名体识别,情感分析,文本纠错,文本转拼音,文本摘要,偏旁部首,句子表征及文本相似度计算等功能

项目最后更新:11/12/22

GitHub Stars

1.3K

Forks数量

184

贡献者数量

5

许可证

Apache-2.0

收录理由

xmnlp 通过一次 pip 安装就能覆盖中文文本处理里最常遇到的几类任务:基于 RoBERTa 和 CRF 的分词、词性标注、命名实体识别,同时提供情感分析、拼写检查、拼音转换、部首查询以及 TextRank 关键词和摘要提取。对做搜索后端、内容管道或中文产品 QA 工具的团队来说,这种广度省去了把多个库拼在一起的麻烦。分词和标注各区分快速与深度两种模式,处理长文档时可以按需切换速度。模型权重需要单独下载,项目自 2022 年后更新不多,适合当作一个务实、低维护的选项,而不是面向长期生产环境持续迭代的基础设施。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目