#3 · 主分类: 计算机视觉
PaddleOCR
ai4science
chineseocr
document-parsing
document-translation
kie
ocr
paddleocr-vl
pdf-extractor-rag
pdf-parser
pdf2markdown
pp-ocr
pp-structure
rag
将任何PDF或图像文档转化为适用于AI的结构化数据。一个强大且轻量级的OCR工具包,弥合图像/PDF与LLM之间的差距。支持100多种语言。
项目最后更新:07/22/26
GitHub Stars
88.5K
Forks数量
11.3K
贡献者数量
295
许可证
Apache-2.0
收录理由
如果你的业务需要从扫描件、照片或PDF里提取文字和版面结构,PaddleOCR是个很实在的选择。它支持上百种语言的文字识别,还能把复杂的文档布局转成Markdown或JSON,正好喂给大模型做RAG检索,或者用来抽取表单和表格。项目里还带了一个轻量的视觉语言模型,专门处理文档解析,你可以根据手头的硬件在经典OCR的速度和VLM的精度之间做取舍。它能在CPU和GPU上跑,也接得上常见的Agent和RAG框架,团队从原型验证到正式上线不用推翻重来。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。