#116 · 主分类: 知识库与企业搜索

FlashRank

cross-encoder full-text-search hybrid-search lexical-search rag ranking reranking retrieval-augmented-generation semantic-search vector-database vector-search

轻量且超快的重排序,适用于您的搜索与检索管道。支持基于LLM和交叉编码器的最先进Listwise和Pairwise重排序等。由Prithivi Da创建,欢迎提交PR和合作。

项目最后更新:07/11/26

GitHub Stars

1.0K

Forks数量

72

贡献者数量

9

许可证

Apache-2.0

收录理由

检索的第一阶段往往带回大量候选结果,真正决定这些噪声有多少能到达大模型手里的,是紧随其后的重排序环节。FlashRank 就是为这一步准备的轻量 Python 库,它既支持基于交叉编码器的紧凑模型,也支持基于 LLM 的 listwise 重排序。最吸引人的地方在于它的体积:默认模型只有几兆大小,在 CPU 上就能跑,不需要安装 Torch 或 Transformers,这让无服务器部署的冷启动时间更短,单次调用的成本也更低。做 RAG、混合检索或文档语义搜索的团队,不用搭建重型基础设施就能提升精度。库内提供了多种模型可选,包括多语言和针对特定领域微调的版本,你可以根据数据特点和延迟预算在速度与准确率之间做取舍。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目