#12 · 主分类: 计算机视觉
tesseract.js
deep-learning
javascript
ocr
tesseract
webassembly
纯JavaScript OCR,支持100多种语言 📖🎉🖥
项目最后更新:05/17/26
GitHub Stars
38.7K
Forks数量
2.4K
贡献者数量
86
许可证
Apache-2.0
收录理由
Tesseract.js 把经典的 Tesseract OCR 引擎移植到了 JavaScript 生态里,借助 WebAssembly 在浏览器中直接运行,也能跑在 Node.js 服务端,省去了单独部署识别服务的麻烦。它支持超过一百种语言的文字提取,覆盖面相当广。实际使用中,worker 机制很贴心:只需初始化一次,就能反复处理多张图片,批量识别时效率明显提升。同时,它还能返回段落、单词、字符级别的边界框,方便做版面分析或搭建自定义的文本抽取流程。对于想在 Web 应用里集成 OCR、又不想在后端引入原生依赖的团队来说,这个库提供了很顺手的解决方案。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。