#142 · 主分类: 自然语言处理与文本处理
Chinese_models_for_SpaCy
chinese-nlp
nlp
nlp-dependency-parsing
nlp-machine-learning
spacy-models
SpaCy 中文模型 | 支持中文的 SpaCy 模型
项目最后更新:01/04/25
GitHub Stars
673
Forks数量
110
贡献者数量
1
许可证
MIT
收录理由
在 SpaCy 生态里做中文文本处理的人,这个项目是最早能拿到现成中文模型的地方之一。它提供了分词、词性标注、依存句法分析和命名实体识别这些基础能力,模型打包成二进制文件,装好后就能直接接进 SpaCy 流程,用熟悉的 API 处理中文文档。仓库里还完整记录了训练流程和所用到的 OntoNotes 5.0 语料,想自己重新训练或调整模型的话,这些资料很有参考价值。后来 SpaCy 官方中文模型上线,开发时也参考了这个项目,所以这个仓库现在主要处于维护状态,只做 bug 修复。不过作为一套清晰完整的参考实现,它依然能帮你在 SpaCy 上搭起中文 NLP 的整套流程。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。