#125 · 主分类: LLM应用框架
ai
React Native 中的设备端 LLM 执行,兼容 Vercel AI SDK
项目最后更新:07/07/26
GitHub Stars
1.4K
Forks数量
58
贡献者数量
12
许可证
MIT
收录理由
对于想在移动端引入大模型能力、却又不愿自建推理服务的团队来说,这个库提供了一个真正可落地的端侧方案。它把 Apple 的 Foundation Models、用于 GGUF 文件的 llama.rn 以及 MLC 运行时统一封装成与 Vercel AI SDK 对齐的接口,Web 开发者可以把熟悉的调用方式直接迁移到 React Native,不必重新学习一套技术栈。除了聊天和文本生成,它还覆盖了嵌入(可支撑本地 RAG)、语音转写和语音合成,很适合离线优先或对隐私敏感的 App——用户数据不必离开手机。模型管理也做得很清晰:Apple 模型在 iOS 上开箱即用,而 GGUF 和 MLC 模型则需要显式下载(带进度反馈)并经过 prepare/unload 周期来管控内存。另外还附带一个可选的开发者工具分析器,能捕获 AI SDK 请求的 OpenTelemetry 追踪信息,方便团队在真实环境中排查移动端推理问题。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
langchain
智能体工程平台。
dify
在一个协作工作区中构建Agentic工作流、RAG管道,支持丰富的AI模型和工具。可部署在云、VPC或自托管环境,团队无需重建技术栈即可从原型走向生产。
headroom
压缩工具输出、日志、文件和RAG块,再送入LLM。编码代理减少20% token,JSON减少60-95% token,答案不变。提供库、代理、MCP服务器。
litellm
最快的、最轻量的AI网关。Rust核心,Python SDK。以OpenAI(或原生)格式调用100多种LLM API,具备成本追踪、护栏、负载均衡和日志记录 [Bedrock, Azure, OpenAI, Anthropic, OpenAI, VertexAI, vLLM, Nvidia NIM]
llama_index
LlamaIndex 是领先的文档代理和 OCR 平台