#46 · 主分类: 深度学习框架

LMFlow

chatgpt deep-learning instruction-following language-model pretrained-models pytorch transformer

一个用于大型基础模型微调和推理的可扩展工具包。让大模型惠及所有人。

项目最后更新:08/10/26

GitHub Stars

8.5K

Forks数量

825

贡献者数量

48

许可证

Apache-2.0

收录理由

LMFlow 是一个面向实际工程场景的工具包,适合那些想把开源权重模型改造成自己专属模型的团队。它把数据准备、全量或 LoRA 微调、推理服务整合成一条完整流水线,不需要自己拼凑各种脚本,就能让模型从原始数据一路走到线上部署。内存优化是它的亮点:LISA 技术可以在不卸载参数的情况下,用约 24GB 显存训练 7B 规模模型,这意味着单个研究员用一块 GPU 也能认真做微调。项目还提供了开箱即用的脚本、针对 Llama-3、Phi-3 等模型的对话模板,以及加速生成的投机解码功能,实际任务能很快跑起来,后续再逐步调优。做指令微调、领域适配或轻量对齐实验时,这里是一个文档完善、上手顺手的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目