#212 · 主分类: 推理与本地部署

gpt-llama.cpp

llama.cpp 的即插即用替代品,用于 OpenAI 的 GPT 端点,使基于 GPT 的应用能够运行本地 llama.cpp 模型,而非 OpenAI。

项目最后更新:06/12/23

GitHub Stars

591

Forks数量

66

贡献者数量

6

许可证

MIT

收录理由

许多为OpenAI聊天和补全接口编写的应用,默认都假设模型跑在云端。这个项目却让你保留原有代码,把请求指向本地的llama.cpp模型。它启动一个小型服务,模拟OpenAI的GPT端点,于是chatbot-ui、Auto-GPT、LangChain这类工具就能直接对接你机器上的模型,不必再依赖付费服务。对受隐私约束、或在意按次计费成本的团队来说,这很有吸引力;需要推理留在本地的场景同样适用。仓库持续跟进llama.cpp的更新,还附带了多个常见GPT应用的配置指南,切换过程因此顺畅不少。需要留意的是,它只是一个兼容层,本身不负责模型推理,运行前仍需准备好llama.cpp和量化后的模型文件。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目