#44 · 主分类: 推理与本地部署

GenieX

gemma4 go gpt-oss granite4 hexagon llama3 llm local-ai on-device-ai qualcomm qwen3 qwen3vl sdk snapdragon vlm

通过几行代码,在骁龙设备上的NPU、GPU和CPU上本地运行前沿LLM和VLM。

项目最后更新:08/28/26

GitHub Stars

8.3K

Forks数量

1.0K

贡献者数量

20

许可证

BSD-3-Clause

收录理由

如果你的软件跑在骁龙平台上,GenieX 可以让你用几行代码,就把 Hugging Face 上的 GGUF 模型或高通 AI Hub 的预编译包,直接调度到 Hexagon NPU、Adreno GPU 或 CPU 上执行。它底层是一个统一的 C 运行时,却同时提供了命令行、Python 绑定、面向 Android 的 Kotlin/Java 接口、Docker 镜像以及一个兼容 OpenAI 的本地服务,换接口时完全不用动模型层。对于需要离线运行或对隐私敏感的移动端和边缘侧应用来说,这能实实在在把前沿大语言模型或多模态视觉模型跑在本地,而不必依赖云端。仓库里还附带了一些 Android 示例应用,做原型验证时很方便,尤其是当你想做一个仍然能对接现有工具链的端侧助手时。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目