#19 · 主分类: 推理与本地部署

web-llm

chatgpt deep-learning language-model llm tvm webgpu webml

高性能浏览器内LLM推理引擎

项目最后更新:08/04/26

GitHub Stars

18.6K

Forks数量

1.4K

贡献者数量

54

许可证

Apache-2.0

收录理由

WebLLM 把 Llama、Phi、Gemma、Mistral、Qwen 这些开源模型完整地跑在浏览器里,靠 WebGPU 做硬件加速,既不用搭服务器,也不用操心推理账单。所有计算都在本地设备上完成,用户数据不会离开机器,这让它特别适合对隐私敏感的助手类应用和离线工具。它对外提供与 OpenAI 兼容的聊天接口,也就是说,你原本用来对接云端模型的客户端代码,可以直接指向这个浏览器内的本地后端,流式输出、JSON 模式、函数调用这些能力都支持。项目以 npm 包形式发布,内部是模块化的 MLCEngine 接口,可以轻松嵌入现有 Web 应用、Chrome 扩展或基于 Worker 的界面,不绑定任何特定框架。对于想用大模型功能又不想自己托管服务的团队来说,从原型验证到正式上线,这是一条走得通的路。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目