#39 · 主分类: 知识库与企业搜索
PixelRAG
https://arxiv.org/abs/2606.28344。网页解析的终结。可扩展像素原生搜索的开端。链接:https://pixelrag.ai/
项目最后更新:08/29/26
GitHub Stars
9.8K
Forks数量
836
贡献者数量
20
许可证
Apache-2.0
收录理由
传统的检索流程往往会把页面视觉布局中蕴含的信息白白丢掉,而 PixelRAG 换了一条路:先把文档渲染成截图瓦片,再对这些图像建索引,这样图表、排版和结构这些纯文本提取会遗漏的内容,也能被搜索命中。工具本身很轻,核心就两个命令——一个把页面渲染成瓦片,另一个查询视觉索引,另外它还提供了一个包含 828 万维基百科页面的托管索引,不用自己搭流程就能直接试。这个项目源自伯克利的研究,他们对比了截图和文本在检索上的表现,发现视觉方案在实际中站得住脚。对于想评估视觉检索是否适合自己的语料的小团队来说,真实的评测加上能跑通的演示,是最快验证想法的途径。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
ragflow
RAGFlow 是一款领先的开源检索增强生成(RAG)引擎,将前沿 RAG 与 Agent 能力融合,为大型语言模型(LLM)打造卓越的上下文层。
Understand-Anything
教学型图表优于炫技型图表。将任意代码转化为可探索、搜索和提问的交互式知识图谱。支持Claude Code、Codex、Cursor、Copilot、Gemini CLI等。
crawl4ai
🚀🤖 Crawl4AI:开源的、对LLM友好的网页爬虫与抓取工具。别害羞,加入这里:https://discord.gg/jP8KfhDhyN
docling
为生成式AI准备文档
anything-llm
停止租用你的智能。用AnythingLLM拥有它。你需要的一切,实现强大的本地优先智能体体验。