#235 · 主分类: 自然语言处理与文本处理
Deep-Semantic-Similarity-Model
我的Keras实现,针对Deep Semantic Similarity Model (DSSM)/Convolutional Latent Semantic Model (CLSM),描述见:http://research.microsoft.com/pubs/226585/cikm2014_cdssm_final.pdf.
项目最后更新:06/05/17
GitHub Stars
521
Forks数量
179
贡献者数量
2
许可证
MIT
收录理由
微软研究院早年为解决查询与文档匹配问题提出深度语义相似性模型,其思路是把查询和文档映射到同一个向量空间,再进行相似度比较。这个代码库用Keras同时实现了基础版DSSM和卷积版CLSM,并且严格贴近2014年那篇原论文,从哈希到池化的每一步都能对照阅读,很适合学生和工程师当作理解神经检索演进的入门材料。作者也提醒,搜索数据集通常不公开,你需要自己准备查询和文档对。对于那些仍在做匹配任务的团队,比如去重或候选检索,这个模型依然是个干净利落的基线,值得读一读并动手改造,即便日后会用更现代的模型替换。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。