#45 · 主分类: 计算机视觉

chandra

ai ocr

处理复杂表格、表单、手写内容及完整布局的OCR模型。

项目最后更新:06/26/26

GitHub Stars

12.2K

Forks数量

1.2K

贡献者数量

5

许可证

Apache-2.0

收录理由

Chandra 能把扫描件和 PDF 转成结构化的 Markdown、HTML 或 JSON,而不是把整页压成一段纯文本。真正棘手的内容它也能处理:密集的表格、带勾选框的表单、手写笔记、数学公式,还有多栏排版——这些场景里,普通 OCR 工具往往会把结构弄丢。输出是机器可读的,做搜索索引、信息抽取或发布流程的团队,可以直接把结果接进自己的系统,省掉二次解析。它支持九十多种语言,文档不只有英文时,这一点尤其管用。开放权重可以本地跑,通过 Hugging Face 或 vLLM 服务器部署;另外还附带了命令行工具和一个小型网页应用,方便你在动手集成之前先试一试效果。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目