#92 · 主分类: 知识库与企业搜索
xerj
面向AI智能体的一键自动索引搜索引擎,兼容Elasticsearch,token使用量比grep少40倍。
项目最后更新:08/29/26
GitHub Stars
1.7K
Forks数量
241
贡献者数量
13
许可证
Apache-2.0
收录理由
把散落的代码、文档、日志和 PDF 变成大模型能直接查询的数据,往往是团队在构建 AI 代理时最头疼的一步。XERJ 直接解决这个问题:对着一个文件夹运行 autoindexer,它能自动识别文件类型,用 tree-sitter 解析源码从而保留符号和行号,并为识别出的每个数据集建立独立的搜索索引。由于服务端兼容 Elasticsearch API,现有仪表盘和客户端库无需改动即可接入,同一套索引还能同时支撑关键词、向量和混合检索,服务于 RAG 流程或长期代理记忆。整个工具是一个静态二进制文件,不需要 JVM 或其他运行时依赖,自托管部署非常轻量。与其让代理把整个文件读进上下文窗口,不如让它直接向自己的数据提问——XERJ 正是为此而生。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
ragflow
RAGFlow 是一款领先的开源检索增强生成(RAG)引擎,将前沿 RAG 与 Agent 能力融合,为大型语言模型(LLM)打造卓越的上下文层。
Understand-Anything
教学型图表优于炫技型图表。将任意代码转化为可探索、搜索和提问的交互式知识图谱。支持Claude Code、Codex、Cursor、Copilot、Gemini CLI等。
crawl4ai
🚀🤖 Crawl4AI:开源的、对LLM友好的网页爬虫与抓取工具。别害羞,加入这里:https://discord.gg/jP8KfhDhyN
docling
为生成式AI准备文档
anything-llm
停止租用你的智能。用AnythingLLM拥有它。你需要的一切,实现强大的本地优先智能体体验。