#120 · 主分类: 自然语言处理与文本处理

nlp_xiaojiang

bert chatbot chinese data-augmentation distance enhance feature nlp text-augment text-classification xlnet

自然语言处理(NLP),小姜机器人(闲聊检索式聊天机器人),BERT句向量-相似度(句子相似度),XLNET句向量-相似度(文本xlnet嵌入),文本分类,实体提取(NER,BERT+BiLSTM+CRF),数据增强(文本增强,数据增强),同义句同义词生成,句子主干提取(mainpart),中文汉语短文本相似度,文本特征工程,keras-http-service调用

项目最后更新:09/23/21

GitHub Stars

1.5K

Forks数量

390

贡献者数量

2

许可证

MIT

收录理由

这个中文自然语言处理工具包把常见的文本处理任务集中在一个代码库里,省去了自己拼接多个组件的麻烦。它支持用BERT和XLNET做句向量相似度计算,提供多种基于Keras的文本分类模型,还集成了BERT+BiLSTM+CRF的命名实体识别流程,以及回译、EDA、seq2seq等数据增强方法。检索式聊天机器人通过句向量匹配问题,而不是依赖字面字符串,另外还有文本距离计算和句子主干提取的工具。如果你在做中文文本分类、相似度匹配,或者想扩充训练数据,这些开箱即用的示例是不错的起点。需要注意的是,部分预训练模型和词向量需要单独下载,项目环境是Python 3.6。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目