#115 · 主分类: 图像生成
DragDiffusion
[CVPR2024 Highlight] DragDiffusion官方代码
项目最后更新:01/29/24
GitHub Stars
1.3K
Forks数量
95
贡献者数量
1
许可证
Apache-2.0
收录理由
日常修图往往离不开遮罩和重绘,但DragDiffusion换了一种更直接的玩法:在图上点一个控制点,把它拖到目标位置,扩散模型就会自动重画相应区域,让改动看起来浑然一体。在真实照片上,它比早先的DragGAN方法连贯得多。仓库里是CVPR 2024论文的官方代码,还附带DragBench——一套含代码和数据的点式编辑评测基准,想对比不同方法或自建测试时很顺手。不过用起来需要熟悉diffusers、对真实图像编辑做LoRA微调,还要有一块像样的GPU,更适合打算复现论文或搭建交互式编辑流程的研究者和工程师,普通用户上手会有些门槛。而且这毕竟是研究代码,官方声明里也讲清楚了不是商业产品,真要拿到生产环境里用,得自己先做适配和加固。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
stable-diffusion-webui
Stable Diffusion 网页界面
ComfyUI
最强大且模块化的扩散模型GUI、API和后端,具有图形/节点界面。
diffusers
🤗 Diffusers:PyTorch中最先进的扩散模型,用于图像、视频和音频生成。
upscayl
🆙 Upscayl - 适用于 Linux、MacOS 和 Windows 的 #1 免费开源 AI 图像放大工具。
InvokeAI
InvokeAI 是领先的开源创意引擎,专为 Stable Diffusion 设计,提供业界领先的 Web UI,用于生成和编辑视觉媒体。