#216 · 主分类: 自然语言处理与文本处理
BertSimilarity
用谷歌的BERT算法计算两个句子的相似度。
项目最后更新:03/24/23
GitHub Stars
510
Forks数量
67
贡献者数量
1
许可证
Other
收录理由
这个仓库把BERT相似度模型的内部分解得很清楚,作者从数据预处理讲起,句子先切分成字,再用[CLS]和[SEP]拼成标准输入,接着送入谷歌预训练的中文BERT,最后接上Dropout和softmax输出相似与不相似的概率。每一步都有文字说明和示意图,读起来像一份细致的技术笔记,而不是冷冰冰的代码库。启动脚本覆盖训练、评估和推理三种模式,还附带了训练好的参数文件,想快速体验语义相似度计算的话,可以直接跳到推理环节。不过要注意,它基于TensorFlow 1和2018年的中文BERT模型,更适合作教学范本或二次开发的起点,离生产环境还有距离。如果你的工作涉及中文句子配对,比如查重、找相似问题或做语义搜索,这个项目能帮你快速建立直观的认识。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。