#146 · 主分类: MLOps与评测

Firefly

alpaca aquila baichuan chatglm gemma gpt internlm llama llama2 llama3 llm lora minicpm mistral mixtral peft qlora qwen qwen2 zephyr

Firefly: 大模型训练工具,支持训练Qwen2.5、Qwen2、Yi1.5、Phi-3、Llama3、Gemma、MiniCPM、Yi、Deepseek、Orion、Xverse、Mixtral-8x7B、Zephyr、Mistral、Baichuan2、Llma2、Llama、Qwen、Baichuan、ChatGLM2、InternLM、Ziya2、Vicuna、Bloom等大模型

项目最后更新:10/24/24

GitHub Stars

6.7K

Forks数量

583

贡献者数量

2

许可证

Other

收录理由

Firefly 是一个面向实际训练场景的工具包,特别适合那些想微调开源模型而不是从零训练模型的团队。它通过配置文件驱动脚本,支持预训练、指令微调和 DPO 偏好对齐,覆盖的模型范围很广,包括 Qwen、Llama、Yi、Gemma、MiniCPM、DeepSeek、Mistral、Mixtral、Baichuan、ChatGLM、InternLM 等等。训练模板和各个官方对话模型对齐,换用不同架构时不需要自己重新整理数据格式,省去不少麻烦。如果 GPU 显存有限,这个项目也很友好:QLoRA 是官方推荐的省显存方案,效果在 Open LLM Leaderboard 上验证过;另外集成了 Unsloth 加速,训练 Llama3-8B 只需约 7.75 GB 显存,同时训练速度更快。既有广泛的模型支持,又有低硬件门槛的选项,小团队想快速上手适配一个基础模型,从这里开始会是个明智的选择。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目