#1 · 主分类: 推理与本地部署
ollama
快速上手使用 Kimi-K2.6、GLM-5.2、MiniMax、DeepSeek、gpt-oss、Qwen、Gemma 等模型。
项目最后更新:08/29/26
GitHub Stars
179.7K
Forks数量
17.6K
贡献者数量
614
许可证
MIT
收录理由
过去想在自有硬件上跑开源模型,往往得直接跟 llama.cpp 较劲,配置和调用都费神。Ollama 把这层复杂度收拢成简洁的命令行和 REST 接口:拉取 Qwen、Gemma 这类模型,一条命令就能开始对话,自己的应用也能直接指向本地端点。它提供的 REST API 以及官方 Python、JavaScript 客户端,让接入现有代码库变得顺手;Docker 镜像则方便在服务器上干净地部署。模型管理、Modelfile 定义、自定义权重导入这些本地推理的琐碎环节,它也都替你处理好了。正因如此,自托管大模型的工作流里,它成了许多人默认的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。