#137 · 主分类: LLM应用框架
GPTCache
用于LLM的语义缓存,与LangChain和llama_index完全集成。
项目最后更新:07/11/25
GitHub Stars
8.2K
Forks数量
594
贡献者数量
43
许可证
MIT
收录理由
GPTCache 为 LLM 查询提供语义级缓存,不再依赖逐字匹配,而是通过向量相似度判断问题是否重复。因此,即便用户换个说法提问,只要语义相近,就能直接复用之前的回答,省下重复调用大模型接口的开销。对于聊天机器人、客服工具或检索类应用,这类需要频繁向 OpenAI 等模型发送相似请求的场景,它能把成本降下来,同时响应也更快。使用起来并不复杂:选定一种嵌入函数,在 SQLite、FAISS、Redis 或 Milvus 中挑一个作为存储,再设定相似度阈值,之后库会自动处理完全重复和近似重复的查询。它还能通过适配器接入 LangChain 和 llama_index。官方还提供了服务器镜像,非 Python 技术栈也能共用这套缓存。需要留意的是,维护者已不再为层出不穷的新模型 API 逐一添加适配器,而是建议用户直接使用通用的 get/set 接口。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
langchain
智能体工程平台。
dify
在一个协作工作区中构建Agentic工作流、RAG管道,支持丰富的AI模型和工具。可部署在云、VPC或自托管环境,团队无需重建技术栈即可从原型走向生产。
headroom
压缩工具输出、日志、文件和RAG块,再送入LLM。编码代理减少20% token,JSON减少60-95% token,答案不变。提供库、代理、MCP服务器。
litellm
最快的、最轻量的AI网关。Rust核心,Python SDK。以OpenAI(或原生)格式调用100多种LLM API,具备成本追踪、护栏、负载均衡和日志记录 [Bedrock, Azure, OpenAI, Anthropic, OpenAI, VertexAI, vLLM, Nvidia NIM]
llama_index
LlamaIndex 是领先的文档代理和 OCR 平台