#5 · 主分类: 计算机视觉
tesseract
Tesseract开源OCR引擎(主仓库)
项目最后更新:08/25/26
GitHub Stars
76.2K
Forks数量
10.8K
贡献者数量
241
许可证
Apache-2.0
收录理由
提起开源OCR,大多数人首先想到的就是Tesseract。它作为开放源代码的事实标准已经超过十年,既提供命令行工具,也提供C/C++库,既能快速处理单张图片,也能嵌入到大型文档处理流程中。当前版本基于LSTM神经网络进行行识别,同时保留传统引擎模式以保证兼容性,开箱即可识别一百多种语言,也支持训练新语言。输出格式涵盖纯文本、hOCR、PDF、TSV、ALTO和PAGE,方便下游搜索、索引或数据抽取系统直接使用。做文档数字化、票据解析或档案整理工作的团队,都能从这套稳定且文档完善的工具链中获益,而且它拥有多种编程语言的绑定。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
opencv
开源计算机视觉库
RuView
π RuView 将普通 WiFi 信号转化为实时空间智能、生命体征监测和存在检测——全程无需任何视频像素。
PaddleOCR
将任何PDF或图像文档转化为适用于AI的结构化数据。一个强大且轻量级的OCR工具包,弥合图像/PDF与LLM之间的差距。支持100多种语言。
MinerU
将 PDF 和 Office 文档等复杂文档转换为 LLM 可用的 markdown/JSON,以支持您的智能体工作流。
ultralytics
Ultralytics YOLO26、YOLO11、YOLOv8——目标检测、实例分割、语义分割、图像分类、姿态估计、目标跟踪