#111 · 主分类: 计算机视觉

llm_aided_ocr

ai-assist llama2 llm ocr ocr-correction tesseract

使用LLM(本地或API)增强Tesseract OCR输出,用于错误纠正、智能分块和扫描PDF的Markdown格式化。

项目最后更新:08/03/26

GitHub Stars

3.0K

Forks数量

214

贡献者数量

2

许可证

Other

收录理由

处理扫描档案或旧信函的人都知道,纯靠OCR出来的文本往往错漏百出。这个项目把流程拆成两步:先用Tesseract做初步识别,再让大语言模型通读结果,修正错字、把断开的词拼回去,并将版面整理成易读的Markdown。敏感材料可以调用本地模型,不愿折腾硬件时也能交给OpenAI或Anthropic的云端接口。长文档靠重叠切块来保持上下文连贯,还能选择去掉页眉页码,最后附带的质检环节让你对输出心里有数。对经常要整理法律文件、旧书信这类扫描PDF的团队来说,它省下的正是过去只能靠人慢慢打磨的枯燥功夫。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目