#81 · 主分类: 计算机视觉

sparrow

agentic-ai computer-vision documentai huggingface-transformers llm machinelearning vllm

使用机器学习、大语言模型和视觉大语言模型进行结构化数据提取、指令调用和智能体工作流。

项目最后更新:08/26/26

GitHub Stars

5.2K

Forks数量

519

贡献者数量

4

许可证

GPL-3.0

收录理由

Sparrow 是一套可自行部署的文档处理平台,通过 REST 接口提交文档后,即可获得经过模式校验的 JSON 结果,全程无需将数据交给第三方云服务。它把 OCR 预处理与视觉模型、文本大模型结合起来,处理流程采用可插拔设计,你可以根据具体任务选择基于视觉的解析器、指令调用模型,或者由多个智能体协同完成复杂流程。后端支持 MLX、vLLM、Ollama 和 Hugging Face 等多种运行环境,指令与智能体接口不仅限于信息抽取,还能处理数据校验、逻辑判断以及多步骤工作流。平台附带网页界面和仪表盘,方便监控运行状态。如果团队经常需要把发票、收据、银行对账单、表单或表格转换成结构化记录,这套方案能让你在自己的硬件上稳妥地完成这类工作。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目