#166 · 主分类: 推理与本地部署
api-for-open-llm
baichuan
chatglm
code-llama
docker
internlm
langchain
llama
llama2
llms
nlp
openai
qwen
sqlcoder
xverse
开源大模型的统一后端接口
项目最后更新:09/26/24
GitHub Stars
2.5K
Forks数量
271
贡献者数量
16
许可证
Apache-2.0
收录理由
自己托管一个开源大模型,通常得费劲把推理服务接进现有系统,而这个项目直接给你一个现成的 OpenAI 兼容接口。它把 LLaMA、Qwen、ChatGLM、Baichuan、Yi 等模型统一成熟悉的 chat-completions 格式,应用和 LangChain 工具想从商业 API 切到本地模型,改改环境变量就行,不用重写代码。实际用到的细节也考虑到了:支持流式输出、提供文本嵌入给检索增强、能加载你自己微调过的 LoRA 权重,需要高并发时还可以选 vLLM 加速。想拿开源模型当更便宜或更可控的后端来试,这是把它们快速放到标准接口后面的省事路子。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。