#166 · 主分类: 推理与本地部署

api-for-open-llm

baichuan chatglm code-llama docker internlm langchain llama llama2 llms nlp openai qwen sqlcoder xverse

开源大模型的统一后端接口

项目最后更新:09/26/24

GitHub Stars

2.5K

Forks数量

271

贡献者数量

16

许可证

Apache-2.0

收录理由

自己托管一个开源大模型,通常得费劲把推理服务接进现有系统,而这个项目直接给你一个现成的 OpenAI 兼容接口。它把 LLaMA、Qwen、ChatGLM、Baichuan、Yi 等模型统一成熟悉的 chat-completions 格式,应用和 LangChain 工具想从商业 API 切到本地模型,改改环境变量就行,不用重写代码。实际用到的细节也考虑到了:支持流式输出、提供文本嵌入给检索增强、能加载你自己微调过的 LoRA 权重,需要高并发时还可以选 vLLM 加速。想拿开源模型当更便宜或更可控的后端来试,这是把它们快速放到标准接口后面的省事路子。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目