#110 · 主分类: 计算机视觉
paperless-gpt
使用LLM和LLM视觉(OCR)处理paperless-ngx——由AI驱动的文档数字化
项目最后更新:08/28/26
GitHub Stars
2.7K
Forks数量
204
贡献者数量
32
许可证
MIT
收录理由
如果你维护着一个扫描件堆积如山的 paperless-ngx 档案库,会发现 OCR 往往是整理流程里最费时的环节。这个工具直接接上你已有的实例,借助 OpenAI、Ollama 这类大模型的视觉能力,也支持 Azure 和 Google Document AI 等云端服务,把模糊或低质量的扫描件转成更贴合上下文的文字,并写回 PDF 的文本层,让搜索真正可用。它还会顺手给出文档标题、标签、通信方和自定义字段的建议,所有改动都能在网页界面里先过目再应用。这种人工确认的掌控感,加上比传统 OCR 更聪明的识别效果,让它比那些只会自动打标签的工具更进了一步。用 Docker 部署,自托管起来也不费劲。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。