#16 · 主分类: 推理与本地部署
mlc-llm
language-model
llm
machine-learning-compilation
tvm
通用LLM部署引擎,支持ML编译
项目最后更新:08/17/26
GitHub Stars
23.1K
Forks数量
2.1K
贡献者数量
164
许可证
Apache-2.0
收录理由
MLC LLM 把大语言模型编译成针对你实际硬件的优化原生代码,无论是 NVIDIA、AMD 显卡,还是 Apple 芯片、Intel 核显、手机乃至浏览器,都能跑起来。对想在自己机房或边缘设备上跑模型、不想租云 GPU 的团队来说,它特别合适——同一个模型编译一次,就能部署到各种差异很大的目标平台上。它还通过 REST 服务提供兼容 OpenAI 的接口,并支持 Python、JavaScript、iOS 和 Android 的绑定,接入现有工具链几乎不用折腾。如果你在意消费级或移动硬件上的性能表现,或者希望推理过程完全自托管,这个项目值得仔细研究。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。