#110 · 主分类: 计算机视觉

paperless-gpt

ai chatgpt llm mistral ocr ollama paperless paperless-ngx

使用LLM和LLM视觉(OCR)处理paperless-ngx——由AI驱动的文档数字化

项目最后更新:08/28/26

GitHub Stars

2.7K

Forks数量

204

贡献者数量

32

许可证

MIT

收录理由

如果你维护着一个扫描件堆积如山的 paperless-ngx 档案库,会发现 OCR 往往是整理流程里最费时的环节。这个工具直接接上你已有的实例,借助 OpenAI、Ollama 这类大模型的视觉能力,也支持 Azure 和 Google Document AI 等云端服务,把模糊或低质量的扫描件转成更贴合上下文的文字,并写回 PDF 的文本层,让搜索真正可用。它还会顺手给出文档标题、标签、通信方和自定义字段的建议,所有改动都能在网页界面里先过目再应用。这种人工确认的掌控感,加上比传统 OCR 更聪明的识别效果,让它比那些只会自动打标签的工具更进了一步。用 Docker 部署,自托管起来也不费劲。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目