#393 · 主分类: 教育与研究

Jackrong-llm-finetuning-guide

dataset deepseek fine-tuning guide llama3 llm machine-learning nlp openai pytorch qwen unsloth

一个开源教育指南,涵盖LLM微调、强化学习、数据集蒸馏和本地部署。

项目最后更新:07/11/26

GitHub Stars

1.7K

Forks数量

269

贡献者数量

1

许可证

Apache-2.0

收录理由

这份开源资料更像是一门可以在浏览器里逐步完成的课程,而不是零散的教程。仓库里收集了可直接运行的 Colab 和 Kaggle 笔记本,覆盖监督微调以及 GRPO、GSPO 等强化学习方法,还包含数据准备和蒸馏的配方。数据集目录和长文指南会带着你从原始数据一路走到部署 GGUF 检查点,省去在零散博客之间拼凑信息的麻烦。另外还专门提供了把 Qwen 模型转换成支持 MTP 的 GGUF 文件的流程,方便本地或智能体使用。整个项目按任务组织,开发者可以沿着一条清晰的路径,从头到尾跑通微调全流程。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目