#120 · 主分类: 推理与本地部署

mllm

ai llama llm mobile multimodal

移动设备上的快速多模态大语言模型

项目最后更新:08/19/26

GitHub Stars

1.6K

Forks数量

213

贡献者数量

33

许可证

MIT

收录理由

mllm 是一款面向手机与边缘设备的 C++ 推理运行时,专为在本地运行多模态大模型而设计,而非依赖云端。它支持 Arm CPU、x86、Apple Silicon,以及通过 QNN 接入的高通 NPU,并在 Jetson 板上提供实验性的 CUDA 支持。引擎自带一套类似 PyTorch 的 Pythonic API,支持 eager 执行与图追踪,开发者可以定义或改造模型,再将其编译为面向 NPU 优化的静态表示。核心之外还提供了 C SDK、基于 Go 的命令行工具和模型转换器,方便从常见格式导入权重,把运行时嵌入实际产品。文档覆盖 Android、x86、macOS 与 Docker 的构建步骤,可以帮你评估本地推理在自己硬件上的表现。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目