#36 · 主分类: AI网关与API基础设施

llama-swap

golang llama llamacpp localllama localllm openai openai-api vllm

适用于任何本地 OpenAI/Anthropic 兼容服务器的可靠模型交换 - llama.cpp、vllm 等

项目最后更新:08/29/26

GitHub Stars

5.5K

Forks数量

444

贡献者数量

70

许可证

MIT

收录理由

本地跑多个模型通常意味着要同时维护好几个服务进程和各自的配置,llama-swap 直接挡在 OpenAI 或 Anthropic 兼容的后端前面,你请求哪个模型它就加载哪个,用完自动卸载腾出显存。一个二进制加一个配置文件,就能替代原来那堆 llama.cpp、vLLM、tabbyAPI 或 stable-diffusion.cpp 实例。白天在不同模型之间切换时,客户端始终指向同一个接口,真正换的只是背后的上游服务。它还带一个简易的网页界面和几个管理端点,能查看当前已加载的模型,也可以手动强制卸载。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目