#71 · 主分类: 图像生成

ICEdit

diffusion diffusion-models diffusion-transformer dit editing-image gpt4o gpt4oimage image-editing in-context

[NeurIPS 2025] 图像编辑只需一个LoRA!仅需0.1%的训练数据即可实现惊艳的图像编辑!在身份保持方面超越GPT-4o~ MoE检查点已发布!仅需4GB显存即可运行!

项目最后更新:12/19/25

GitHub Stars

2.1K

Forks数量

110

贡献者数量

5

许可证

Other

收录理由

ICEdit把指令式图像编辑当作扩散Transformer上的上下文生成任务来处理,仅用一个轻量LoRA适配器就能完成多轮连续编辑,并且在编辑过程中保持主体身份稳定。作者开源了Hugging Face演示和MoE权重,推理时显存占用约4GB,普通开发机即可运行,不必依赖大规模GPU集群。对想微调编辑模型的人来说,它的数据与参数开销相当克制——只需先前最先进方法约0.5%的训练数据和1%的参数,复现和二次适配都变得现实很多。需要留意的是,底模FLUX.1 [dev]采用非商业许可,正式发布前请先确认自己的使用场景是否合规。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目