#16 · 主分类: 推理与本地部署

mlc-llm

language-model llm machine-learning-compilation tvm

通用LLM部署引擎,支持ML编译

项目最后更新:08/17/26

GitHub Stars

23.1K

Forks数量

2.1K

贡献者数量

164

许可证

Apache-2.0

收录理由

MLC LLM 把大语言模型编译成针对你实际硬件的优化原生代码,无论是 NVIDIA、AMD 显卡,还是 Apple 芯片、Intel 核显、手机乃至浏览器,都能跑起来。对想在自己机房或边缘设备上跑模型、不想租云 GPU 的团队来说,它特别合适——同一个模型编译一次,就能部署到各种差异很大的目标平台上。它还通过 REST 服务提供兼容 OpenAI 的接口,并支持 Python、JavaScript、iOS 和 Android 的绑定,接入现有工具链几乎不用折腾。如果你在意消费级或移动硬件上的性能表现,或者希望推理过程完全自托管,这个项目值得仔细研究。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目