#118 · 主分类: 知识库与企业搜索
pdf-reader-mcp
为您的AI代理赋予PDF视觉能力——通过MCP提供结构化文本、表格、OCR、视觉证据和页面级引用。原生Rust,本地优先。
项目最后更新:08/30/26
GitHub Stars
906
Forks数量
81
贡献者数量
12
许可证
MIT
收录理由
做 RAG 或文档问答的团队常常被 PDF 卡住——纯文本抽取会把版式打散,表格变成一锅粥,关键数字也无法核对。Citra 以 @sylphx/citra 这个 MCP 服务的形式提供解决方案,它返回的不只是文字,而是带行、列、单元格坐标的结构化文档模型,扫描件走 OCR,还能给出页码和版面位置,让 Agent 引用給人类看时拿得出证据。对做财报、论文或法律卷宗的场景尤其有用,答案带着第几页第几格的位置,比模型凭空编一个数可靠得多。部署也不折腾,一行 npx 就起服务,不需要 Docker 或 API key;OCR 和抽取都在本地 Rust 引擎里跑,PDF 不离开机器。另外,如果原生二进制缺失,服务会直接拒绝工作而不是悄悄降级,生产环境里不会出现无声的错误输出。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
ragflow
RAGFlow 是一款领先的开源检索增强生成(RAG)引擎,将前沿 RAG 与 Agent 能力融合,为大型语言模型(LLM)打造卓越的上下文层。
Understand-Anything
教学型图表优于炫技型图表。将任意代码转化为可探索、搜索和提问的交互式知识图谱。支持Claude Code、Codex、Cursor、Copilot、Gemini CLI等。
crawl4ai
🚀🤖 Crawl4AI:开源的、对LLM友好的网页爬虫与抓取工具。别害羞,加入这里:https://discord.gg/jP8KfhDhyN
docling
为生成式AI准备文档
anything-llm
停止租用你的智能。用AnythingLLM拥有它。你需要的一切,实现强大的本地优先智能体体验。