#154 · 主分类: 知识库与企业搜索

kaggle-CrowdFlower

crowdflower kaggle kaggle-competetion kaggle-crowdflower natural-language-processing nlp product-search relevance-competition search-engine search-relevance semantic-matching semantic-similarity

Kaggle上的CrowdFlower产品搜索结果相关性竞赛第一名解决方案

项目最后更新:09/25/21

GitHub Stars

1.8K

Forks数量

647

贡献者数量

3

许可证

Other

收录理由

如果你在做电商或交易平台的搜索排序,这份代码值得完整过一遍——它来自Kaggle搜索相关性竞赛的冠军方案,核心任务是判断一条查询和商品结果之间的匹配程度。仓库里不是裁剪过的演示笔记本,而是真正能跑通的工程代码:特征生成脚本、带线性booster的XGBoost模型、模型库,以及最终拼出第一名成绩的集成选择步骤,全都摆在明面上。代码的模块化设计让你可以把它套用到类似的排序问题上,配套文档也解释了每个环节背后的考虑。对于正在尝试语义匹配或学习排序的团队,这算是一份很实在的参考,能帮你理清特征工程和模型集成的组织方式;即便竞赛数据已经过时,里面的方法论依旧有借鉴价值。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目