#111 · 主分类: 计算机视觉
llm_aided_ocr
ai-assist
llama2
llm
ocr
ocr-correction
tesseract
使用LLM(本地或API)增强Tesseract OCR输出,用于错误纠正、智能分块和扫描PDF的Markdown格式化。
项目最后更新:08/03/26
GitHub Stars
3.0K
Forks数量
214
贡献者数量
2
许可证
Other
收录理由
处理扫描档案或旧信函的人都知道,纯靠OCR出来的文本往往错漏百出。这个项目把流程拆成两步:先用Tesseract做初步识别,再让大语言模型通读结果,修正错字、把断开的词拼回去,并将版面整理成易读的Markdown。敏感材料可以调用本地模型,不愿折腾硬件时也能交给OpenAI或Anthropic的云端接口。长文档靠重叠切块来保持上下文连贯,还能选择去掉页眉页码,最后附带的质检环节让你对输出心里有数。对经常要整理法律文件、旧书信这类扫描PDF的团队来说,它省下的正是过去只能靠人慢慢打磨的枯燥功夫。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。