GitHub Stars
566
Forks数量
95
贡献者数量
1
许可证
Other
收录理由
多数OCR工具只输出纯文本,这个项目则更进一步。它把DeepSeek-OCR模型封装在React前端和FastAPI后端里,你只需在浏览器上传PDF或图片,就能直接拿到解析结果,不必自己写脚本调用模型。除了文字识别,它还支持版面分析、表格和图表数据提取,并能把文档转成Markdown格式,这对需要把报告和技术图纸送入下游流程的场景很实用。另外,它还能识别CAD图纸、流程图等专业领域图形,这是通用OCR工具通常忽略的部分。代价是需要自行部署:你得有一台Linux机器,配至少7GB显存的GPU,所以它更适合已有自建推理基础设施的团队,而不是指望托管API的用户。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。