#150 · 主分类: 推理与本地部署

LlamaEdge

在本地或边缘运行定制和微调LLM的最简单、最快的方式

项目最后更新:02/08/26

GitHub Stars

1.7K

Forks数量

149

贡献者数量

11

许可证

Apache-2.0

收录理由

推理和部署开源大模型,常常要先对付Python运行时和层层依赖。LlamaEdge换了一条路:推理引擎和兼容OpenAI的API服务打包成一个WasmEdge二进制文件,你用LangChain这类工具搭起的聊天或嵌入服务,直接就有了本地端点,省掉常规配置折腾。整个运行时只有约30MB,不拉取任何Python包,这对边缘设备和小容器很友好。自己的Rust或JavaScript代码能编译成可移植Wasm,在CPU或GPU上跑,笔记本上验证过的原型,搬到服务器也不用改。想找个轻量本地方案替代云端或PyTorch托管服务的团队,会看中这一点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目