GitHub Stars
5.1K
Forks数量
886
贡献者数量
12
许可证
Other
收录理由
中文自然语言处理里,判断哪些词句意思相近,常常是绕不开的麻烦。这个Python库直接把中文词向量和分词流程打包好,用几个简单函数就能拿到词的同近义词、句子的相似度分数、关键词提取以及token向量。这些结果可以直接喂给聊天机器人、问答系统或嵌入检索,省去自己整理同义词数据的功夫。它返回的是普通列表和0到1的分数,所以往模糊匹配或检索链路里塞也很顺手。不过要留意的是,项目从2023年10月起改用春松许可证,机器学习模型包需要购买许可证密钥才能下载,用之前最好先确认一下许可和费用是否符合你的场景。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。