#3 · 主分类: 计算机视觉

PaddleOCR

ai4science chineseocr document-parsing document-translation kie ocr paddleocr-vl pdf-extractor-rag pdf-parser pdf2markdown pp-ocr pp-structure rag

将任何PDF或图像文档转化为适用于AI的结构化数据。一个强大且轻量级的OCR工具包,弥合图像/PDF与LLM之间的差距。支持100多种语言。

项目最后更新:07/22/26

GitHub Stars

88.5K

Forks数量

11.3K

贡献者数量

295

许可证

Apache-2.0

收录理由

如果你的业务需要从扫描件、照片或PDF里提取文字和版面结构,PaddleOCR是个很实在的选择。它支持上百种语言的文字识别,还能把复杂的文档布局转成Markdown或JSON,正好喂给大模型做RAG检索,或者用来抽取表单和表格。项目里还带了一个轻量的视觉语言模型,专门处理文档解析,你可以根据手头的硬件在经典OCR的速度和VLM的精度之间做取舍。它能在CPU和GPU上跑,也接得上常见的Agent和RAG框架,团队从原型验证到正式上线不用推翻重来。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目