#118 · 主分类: 图像生成
MIGC
[CVPR 2024 Highlight] MIGC 和 [TPAMI 2024] MIGC++(官方实现)
项目最后更新:05/15/25
GitHub Stars
614
Forks数量
30
贡献者数量
4
许可证
Other
收录理由
多数文生图模型在面对一条提示词要求生成多个不同物体时,常常会混淆各物体的属性、漏掉某些对象,或者把物体随机散落在画面里。MIGC 作为 CVPR 2024 的 Highlight 论文,提出了一种更直观的控制方式:你可以为每个实例画一个框或蒙版,从而精确指定每个物体的位置和外观。它提供了属性与数量控制,还附带一个用于评估多实例生成效果的基准,以及适配 Stable Diffusion 1.4 的预训练权重。项目配有 WebUI 和 Colab 在线演示,方便你在接入自己的流程之前先上手体验。后续的 MIGC++ 工作发表在 TPAMI 上,新增了迭代编辑模式,能在保持对象身份一致的前提下逐步优化生成结果。需要留意的是,代码仅限非商业研究用途,投入实际项目前请先确认许可条款。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
stable-diffusion-webui
Stable Diffusion 网页界面
ComfyUI
最强大且模块化的扩散模型GUI、API和后端,具有图形/节点界面。
diffusers
🤗 Diffusers:PyTorch中最先进的扩散模型,用于图像、视频和音频生成。
upscayl
🆙 Upscayl - 适用于 Linux、MacOS 和 Windows 的 #1 免费开源 AI 图像放大工具。
InvokeAI
InvokeAI 是领先的开源创意引擎,专为 Stable Diffusion 设计,提供业界领先的 Web UI,用于生成和编辑视觉媒体。