#77 · 主分类: 基础模型
chatglm_finetuning
chatglm 6b 微调和 alpaca 微调
项目最后更新:03/09/25
GitHub Stars
1.5K
Forks数量
170
贡献者数量
4
许可证
Apache-2.0
收录理由
如果你正在用ChatGLM系列模型,并且希望把它调整到自己的业务数据上,这个仓库能直接给你一套能跑起来的训练方案,而不是零散的代码片段。它同时覆盖了全参数微调和几种省显存的做法,包括LoRA、QLoRA、AdaLoRA、IA3和P-Tuning v2,你可以根据手头GPU的余量来选合适的方式。仓库里的shell脚本把数据准备、训练和推理的流程都串好了,对话示例里既有普通聊天,也有工具调用和观察回合,想调出类似智能体行为的话会很有参考价值。项目基于deep_training库和标准的Hugging Face工具链,代码风格贴近常见的PyTorch和transformers用法,上手门槛不高。如果你已经在用ChatGLM,想找个地方集中尝试不同的微调策略,这里是个不错的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。