#41 · 主分类: 教育与研究

self-llm

chatglm chatglm3 gemma-2b-it glm-4 internlm2 llama3 llm lora minicpm q-wen qwen qwen1-5 qwen2

《开源大模型食用指南》针对中国宝宝量身打造的基于Linux环境快速微调(全参数/Lora)、部署国内外开源大模型(LLM)/多模态大模型(MLLM)教程

项目最后更新:08/26/26

GitHub Stars

32.0K

Forks数量

3.1K

贡献者数量

94

许可证

Apache-2.0

收录理由

这份教程是面向国内初学者的开源大模型实操指南,全程基于Linux环境,把环境配置、本地部署、命令行调用、在线Demo搭建以及全参数微调、LoRA、P-tuning等环节串成一条完整的学习路径。它不空谈原理,而是给出可直接复现的步骤,覆盖Qwen、ChatGLM、InternLM、LLaMA、MiniCPM等五十多个主流模型,还专门照顾了AMD显卡和昇腾NPU的用户。学生、研究者或小团队如果不想付费调用API,想自己跑起一个开源模型或做针对性微调,跟着做就能上手。书里还配有具体案例,比如用特定角色的对话数据微调模型,或者搭建数学辅导助手,让人明白同一套流程怎么迁移到自己的数据集上。这是一个由社区持续维护的学习资源,更像一本不断更新的手册,而不是一个可以直接部署的软件。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目