#2 · 主分类: MLOps与评测

LlamaFactory

agent ai deepseek fine-tuning gemma gpt instruction-tuning large-language-models llama llama3 llm lora moe nlp peft qlora quantization qwen rlhf transformers

统一高效微调100+大语言模型与视觉语言模型(ACL 2024)

项目最后更新:08/27/26

GitHub Stars

74.4K

Forks数量

9.1K

贡献者数量

296

许可证

Apache-2.0

收录理由

过去微调一个现代语言模型,往往要把训练器和数据集加载器从好几个库里拼凑起来,费时又容易出错。LLaMA Factory 把这一整套流程收进一个经过验证的工作流里,支持上百个开源权重模型和视觉语言变体,LoRA、QLoRA 和全参数训练都能在同一个界面下完成。团队想拿自己的数据去适配基础模型,无论是做指令微调、偏好对齐还是继续预训练,都能直接从原始数据走到调好的检查点,不用每次重搭管道。它同时提供网页界面、命令行工具和 Python API,既适合研究者交互式地做实验,也方便工程师把微调嵌进自动化流程。对于想在生产环境落地模型定制的人来说,这个项目展示了成熟且经过社区检验的微调栈应该长什么样。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目