#162 · 主分类: 知识库与企业搜索
llm-search
基于LLM的本地文档查询
项目最后更新:01/17/26
GitHub Stars
661
Forks数量
71
贡献者数量
6
许可证
MIT
收录理由
llm-search 是一套用 YAML 文件就能配置的 RAG 流水线,面向那些想在自己文档集上提问、又不想把所有内容都交给云端服务的用户。它能解析 markdown、PDF 和 docx 文件,把稠密向量和 SPLADE 稀疏向量都存进 ChromaDB,并在普通向量检索之上叠加混合搜索、重排序、HyDE 和多查询召回。除了自带网页前端,它还通过 FastAPI 暴露了 MCP 服务器,让 Cursor、Windsurf 或 VS Code Copilot 这类客户端直接查询同一个索引;增量索引机制让新文件加入时无需重建整个库。无论是本地模型还是任何兼容 OpenAI 接口的服务都能接入,深度链接还能直接跳到源文件的具体页面或标题。如果你想要一个完全跑在自己硬件上的私有文档助手,这个项目是个很扎实的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
ragflow
RAGFlow 是一款领先的开源检索增强生成(RAG)引擎,将前沿 RAG 与 Agent 能力融合,为大型语言模型(LLM)打造卓越的上下文层。
Understand-Anything
教学型图表优于炫技型图表。将任意代码转化为可探索、搜索和提问的交互式知识图谱。支持Claude Code、Codex、Cursor、Copilot、Gemini CLI等。
crawl4ai
🚀🤖 Crawl4AI:开源的、对LLM友好的网页爬虫与抓取工具。别害羞,加入这里:https://discord.gg/jP8KfhDhyN
docling
为生成式AI准备文档
anything-llm
停止租用你的智能。用AnythingLLM拥有它。你需要的一切,实现强大的本地优先智能体体验。