#52 · 主分类: 推理与本地部署

lemonade

ai amd genai gpu llama llm llm-inference local-server mcp mcp-server mistral npu onnxruntime openai-api qwen radeon rocm ryzen vulkan

Lemonade帮助用户通过自己的GPU和NPU运行优化的大语言模型,从而发现并运行本地AI应用。加入我们的Discord:https://discord.gg/5xXzkMu8Zk

项目最后更新:08/30/26

GitHub Stars

5.5K

Forks数量

479

贡献者数量

131

许可证

Apache-2.0

收录理由

Lemonade 能把个人电脑自带的 NPU 或 GPU 变成一台本地 AI 服务器,它兼容 OpenAI、Anthropic 和 Ollama 的标准接口,现有客户端和工具无需改动就能直接接入,省去重写集成的麻烦。无论是聊天、写代码、语音还是图像生成,都可以在设备上完成,对 AMD 硬件特别下功夫,像 Ryzen AI、Radeon 和 Strix Halo 这些平台都能发挥得比较充分。模型管理功能支持从 Hugging Face 或 ModelScope 拉取 GGUF、FLM、ONNX 格式的权重,而且提供了 Windows、Linux、macOS 以及 Docker 的安装包。另外还有一个可嵌入的二进制版本,能把多模态推理封装进你自己的应用里,并根据用户机器自动调优,对桌面工具和注重隐私的工作流来说相当实用——想要云服务那样的能力,又不想让数据离开本地,这个方案很合适。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目