#159 · 主分类: 知识库与企业搜索

byaldi

colbert colpali multi-modal nlp rag reranking retrieval

只需几行代码即可使用诸如ColPali之类的后期交互多模态模型。

项目最后更新:01/28/25

GitHub Stars

852

Forks数量

91

贡献者数量

11

许可证

Apache-2.0

收录理由

Byaldi 面向需要在扫描件、PDF 或没有可靠文本层的图片里查找内容的用户。它完全绕开 OCR,而是用 ColPali、ColQwen2 这类晚期交互模型把整页文档当作图像来建索引,再通过一个简洁熟悉的接口返回与查询匹配的页面。加载预训练模型、从文件夹构建索引、检索相关页,甚至往已有索引里追加文档,都只需几次方法调用就能完成。如果你想在投入更重的 RAG 架构之前,先在自己手头的资料上快速试一下视觉检索,这个库提供了很轻便的路径。需要留意的是,它目前仍是预发布版本,索引未做压缩,编码文档时也建议配备 GPU,所以更适合当作原型验证工具,而非可直接上生产的调优方案。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目