#109 · 主分类: LLM应用框架
contextgem
ContextGem:轻松从文档中进行LLM提取
项目最后更新:08/13/26
GitHub Stars
2.0K
Forks数量
184
贡献者数量
4
许可证
Apache-2.0
收录理由
常见的文档抽取工具要么只给出一段自由文本摘要,要么逼着开发者为每种文档格式手写提示词和解析代码。ContextGem 换了一条思路:你可以先定义要抽取的“方面”,比如合同里的具体条款,再定义要推导的“概念”,比如日期、数字或标签。这些组件能串成可复用的流水线,同一套抽取逻辑可以批量应用到成百上千份文件上——对法律、金融这类格式千变万化、但所需字段始终固定的场景特别实用。它既支持云端大模型,也能跑本地模型,项目里还提供了在准确率与成本、延迟之间做取舍的实用建议。如果你希望拿到结构稳定的类型化输出,又不想为每一种新文档重写抽取逻辑,这个框架值得一试。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
langchain
智能体工程平台。
dify
在一个协作工作区中构建Agentic工作流、RAG管道,支持丰富的AI模型和工具。可部署在云、VPC或自托管环境,团队无需重建技术栈即可从原型走向生产。
headroom
压缩工具输出、日志、文件和RAG块,再送入LLM。编码代理减少20% token,JSON减少60-95% token,答案不变。提供库、代理、MCP服务器。
litellm
最快的、最轻量的AI网关。Rust核心,Python SDK。以OpenAI(或原生)格式调用100多种LLM API,具备成本追踪、护栏、负载均衡和日志记录 [Bedrock, Azure, OpenAI, Anthropic, OpenAI, VertexAI, vLLM, Nvidia NIM]
llama_index
LlamaIndex 是领先的文档代理和 OCR 平台