#216 · 主分类: 自然语言处理与文本处理

BertSimilarity

bert nlp python semantic similarity tensorflow

用谷歌的BERT算法计算两个句子的相似度。

项目最后更新:03/24/23

GitHub Stars

510

Forks数量

67

贡献者数量

1

许可证

Other

收录理由

这个仓库把BERT相似度模型的内部分解得很清楚,作者从数据预处理讲起,句子先切分成字,再用[CLS]和[SEP]拼成标准输入,接着送入谷歌预训练的中文BERT,最后接上Dropout和softmax输出相似与不相似的概率。每一步都有文字说明和示意图,读起来像一份细致的技术笔记,而不是冷冰冰的代码库。启动脚本覆盖训练、评估和推理三种模式,还附带了训练好的参数文件,想快速体验语义相似度计算的话,可以直接跳到推理环节。不过要注意,它基于TensorFlow 1和2018年的中文BERT模型,更适合作教学范本或二次开发的起点,离生产环境还有距离。如果你的工作涉及中文句子配对,比如查重、找相似问题或做语义搜索,这个项目能帮你快速建立直观的认识。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目