#31 · 主分类: 推理与本地部署

runanywhere-sdks

android apple-intelligence cpp diffusion-models edge flutter inference ios kotlin llamacpp llm multimodal ollama on-device-ai react-native swift vlm voice-ai web websdk

本地运行AI的生产就绪工具包

项目最后更新:08/29/26

GitHub Stars

10.3K

Forks数量

370

贡献者数量

48

许可证

Other

收录理由

许多团队在把 AI 塞进移动应用、桌面程序或浏览器产品时,往往要自己手工拼接 llama.cpp、ONNX 和 MLX 这些底层引擎,既费时又容易出错。RunAnywhere 用一套共享的 C++ 核心加上统一的 API 把这件事简化了,同时为 Swift、Kotlin、Flutter、React Native、Python 和 Web 提供对应 SDK,这样无论是聊天、视觉、语音、RAG、向量嵌入还是图像生成,一次调用在各类平台上表现一致。它还会根据设备情况自动把请求路由到最合适的引擎——在高通 NPU 上用 QHexRT,苹果芯片上走 MLX,扩散模型交给 Core ML,其余场景落到 llama.cpp,省去了大量针对不同后端的适配工作。默认情况下所有能力都在本地运行,数据不外传,离线使用也顺理成章;结构化输出、工具调用和语音代理管线则覆盖了更复杂的集成需求。对希望用一套统一本地 AI 层替代多个分散引擎绑定的小团队来说,这个项目相当实用。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目