#135 · 主分类: MLOps与评测

finetrainers

ai art artificial-intelligence diffusers diffusion diffusion-models pytorch transformers

可扩展且内存优化的扩散模型训练

项目最后更新:05/26/26

GitHub Stars

1.4K

Forks数量

142

贡献者数量

24

许可证

Apache-2.0

收录理由

现代视频或图像扩散模型的微调,往往先卡在显存上。这个库直接把问题摆在台面上解决:基于 Diffusers 技术栈,支持 CogVideoX、LTX-Video、HunyuanVideo、Wan、Flux、CogView4 等模型的监督微调和 LoRA 训练,配合 FP8 权重转换和梯度检查点,某些视频 LoRA 训练可以压到约 5 GB 显存。训练工程师能用上 DDP、FSDP-2 和上下文并行组成的分布式方案,自定义模型架构也有标准写法,常见数据集布局还能自动识别。仓库里备好了可直接运行的示例脚本,以及整理小型高质量视频数据集的工具,从原始片段到真正跑起训练,不需要自己拼装整套管线。需要留神的是主分支处于活跃开发状态,想要可复现的结果,最好锁定某个稳定发布标签。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目