#32 · 主分类: 自托管文件处理与转换

doc7

document-ai docx-to-markdown local-ai markdown multimodal open-source pdf-to-markdown vision-language-model

通过视觉理解将文档转换为AI就绪的Markdown。

项目最后更新:08/07/26

GitHub Stars

1.2K

Forks数量

47

贡献者数量

1

许可证

MIT

收录理由

doc7 是一个轻量的命令行工具,能把 PDF、Office 文件、扫描件和截图统一转成 Markdown。它的做法是把每一页交给一个兼容 OpenAI 接口的多模态模型来处理,这个模型可以是你本地跑的 LM Studio 或 Ollama,也可以是私有远程端点。它不捆绑 OCR 组件,也不依赖付费的文档解析服务,敏感资料可以始终留在自己的硬件上,成本也容易控制。对于纯图像页面,它能较好地还原公式、图表,甚至能保留示意图内部的结构关系,这些是纯文本抽取容易遗漏的。项目还附带批量处理、HTTP 服务和 Go SDK,方便集成到现有流程。无论是搭建知识库或 RAG 索引的团队,还是想整理内部文档工作流的人,都能用它把杂乱的输入变成模型真正能检索和引用的文本。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目