#101 · 主分类: 推理与本地部署
Bonsai-demo
bonsai
llamacpp
llm
mlx
prism-ml
small-models
Bonsai 演示
项目最后更新:08/28/26
GitHub Stars
2.3K
Forks数量
233
贡献者数量
26
许可证
Apache-2.0
收录理由
这个演示仓库提供了一个轻量级入口,让开发者不必租用 GPU 就能上手测试经过高度压缩的小型语言模型。它把 1-bit、三值化以及最新的 27B 视觉语言模型封装在 llama.cpp 服务端,只需几条设置命令就能拉起带视觉和工具调用能力的聊天界面。针对笔记本、工作站或边缘设备运行模型的场景,仓库给出了硬件相关的配置说明,还附带面向 AI 代理的引导文档,从克隆代码到跑通本地端点都交代得很清楚。虽然它定位是演示而非生产级服务,但用来对比这些紧凑模型与托管方案的差异,再决定后续部署方向,是个不错的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。