#63 · 主分类: 计算机视觉
doctr
deep-learning
document-recognition
ocr
optical-character-recognition
pytorch
tensorflow2
text-detection
text-detection-recognition
text-recognition
docTR(文档文本识别)- 一个无缝、高性能且易于访问的库,用于基于深度学习的OCR相关任务。由t2k持续开发和维护。
项目最后更新:08/28/26
GitHub Stars
6.3K
Forks数量
673
贡献者数量
77
许可证
Apache-2.0
收录理由
docTR 把文本检测与识别整合进同一个预测对象,输入 PDF 或图片后,几行代码就能拿到结构化文本,使用起来非常顺畅。底层两个阶段依然独立,你可以自由搭配检测主干与识别主干,用预训练模型在速度与精度之间做取舍。项目同时支持 PyTorch 和 TensorFlow,团队无论基于哪个框架都能直接上手,而且除了 PDF 和图片,还能处理渲染后的网页。它另外提供版面检测模式,能标出标题、表格、页眉等区域,当你不仅关心文字内容、还关心文字在页面上的位置时,这个功能会很有帮助。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。