#152 · 主分类: 知识库与企业搜索
splade
SPLADE:稀疏神经搜索(SIGIR21, SIGIR22)
项目最后更新:05/03/24
GitHub Stars
1.0K
Forks数量
96
贡献者数量
13
许可证
Other
收录理由
SPLADE 出自 NAVER Labs Europe,是稀疏神经检索模型领域被广泛引用的参考实现。与稠密检索将文本映射为难以检视的固定向量不同,SPLADE 会把查询和文档扩展成带权重的稀疏词项列表。稀疏性意味着检索仍然可以借助倒排索引高效完成,而词项本身又让匹配过程保持可解释——当需要向用户说明某个结果为何排在前面时,这一点尤为实用。仓库覆盖了模型训练、索引构建和查询时检索的完整流程,并附带 BEIR 评测工具和 Hugging Face 上的预训练 v2 权重,你可以在微调自己的模型之前先跑通已有的发布版本。整体更偏向研究代码而非可直接上线的服务,但如果你在做第一阶段的排序,既想要神经模型的泛化能力,又希望保留词法层面的透明度,这里是最完整的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
ragflow
RAGFlow 是一款领先的开源检索增强生成(RAG)引擎,将前沿 RAG 与 Agent 能力融合,为大型语言模型(LLM)打造卓越的上下文层。
Understand-Anything
教学型图表优于炫技型图表。将任意代码转化为可探索、搜索和提问的交互式知识图谱。支持Claude Code、Codex、Cursor、Copilot、Gemini CLI等。
crawl4ai
🚀🤖 Crawl4AI:开源的、对LLM友好的网页爬虫与抓取工具。别害羞,加入这里:https://discord.gg/jP8KfhDhyN
docling
为生成式AI准备文档
anything-llm
停止租用你的智能。用AnythingLLM拥有它。你需要的一切,实现强大的本地优先智能体体验。