#42 · 主分类: 教育与研究
HanLP
面向下一个十年的自然语言处理。分词、词性标注、命名实体识别、句法与语义依存分析、文档分类。
项目最后更新:11/15/25
GitHub Stars
36.5K
Forks数量
10.9K
贡献者数量
47
许可证
Apache-2.0
收录理由
HanLP 把中文文本处理的主干流程都收在了一个 Python 接口里:分词、词性标注、命名实体识别、依存与成分句法分析、语义角色标注、文本分类等任务可以一次调用完成。它预置了数十个在大规模多语种语料上训练好的模型,覆盖 130 种语言,团队不必自己训练就能拿到可用结果。底层基于 PyTorch 和 TensorFlow 2.x,同时支持多任务与单任务模型,嵌入实际业务系统比较顺手。做中文搜索、内容分析或文档处理的人会把它当作可靠的基础组件,研究者也能在多种任务和标注规范里找到试验空间。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
prompts.chat
前身为 Awesome ChatGPT Prompts。分享、发现和收集社区提示词。免费且开源——可自托管,为您的组织提供完全隐私。
JavaGuide
Java 面试 & 后端通用面试指南,覆盖计算机基础、数据库、分布式、高并发、系统设计与 AI 应用开发
system-prompts-and-models-of-ai-tools
精选流行AI助手和编码代理的系统提示、内部工具和AI模型集合。
30-seconds-of-code
编程文章,助你提升开发技能
generative-ai-for-beginners
21节课,开始使用生成式AI构建