#117 · 主分类: 自然语言处理与文本处理
xmnlp
xmnlp:提供中文分词, 词性标注, 命名体识别,情感分析,文本纠错,文本转拼音,文本摘要,偏旁部首,句子表征及文本相似度计算等功能
项目最后更新:11/12/22
GitHub Stars
1.3K
Forks数量
184
贡献者数量
5
许可证
Apache-2.0
收录理由
xmnlp 通过一次 pip 安装就能覆盖中文文本处理里最常遇到的几类任务:基于 RoBERTa 和 CRF 的分词、词性标注、命名实体识别,同时提供情感分析、拼写检查、拼音转换、部首查询以及 TextRank 关键词和摘要提取。对做搜索后端、内容管道或中文产品 QA 工具的团队来说,这种广度省去了把多个库拼在一起的麻烦。分词和标注各区分快速与深度两种模式,处理长文档时可以按需切换速度。模型权重需要单独下载,项目自 2022 年后更新不多,适合当作一个务实、低维护的选项,而不是面向长期生产环境持续迭代的基础设施。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。