#65 · 主分类: 图像生成
mmagic
OpenMMLab 多模态高级生成与智能创建工具箱。解锁魔法 🪄:生成式AI(AIGC)、易用的API、丰富的模型库、扩散模型,用于文本到图像生成、图像/视频恢复/增强等。
项目最后更新:08/06/24
GitHub Stars
7.5K
Forks数量
1.1K
贡献者数量
128
许可证
Apache-2.0
收录理由
MMagic 是 OpenMMLab 推出的一个 PyTorch 工具箱,把文生图、图像修复、编辑等生成式媒体任务收拢到同一套代码框架里,省去在多个独立仓库之间来回切换的麻烦。团队可以直接跑 Stable Diffusion 或 ControlNet 的流程,也能用 DreamBooth 或 LoRA 做微调,模型库中大多常见任务都备好了预训练权重。同一套框架还能兼顾“清理”类工作:超分辨率、修补、抠图、着色、视频插帧都不在话下,当生产链路既要合成又要修复时,这种一体化的设计相当顺手。由于 OpenMMLab 的约定让评估循环和指标在不同任务间保持一致——生成任务用 FID,重建任务用 SSIM/PSNR——研究者和工程人员不必每个项目都重新摸索一套习惯。真正的代价在于要熟悉 MMEngine 和 MMCV 的用法,以及权衡这个工具箱的覆盖面是否比一个更精简的专用库更划算。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
stable-diffusion-webui
Stable Diffusion 网页界面
ComfyUI
最强大且模块化的扩散模型GUI、API和后端,具有图形/节点界面。
diffusers
🤗 Diffusers:PyTorch中最先进的扩散模型,用于图像、视频和音频生成。
upscayl
🆙 Upscayl - 适用于 Linux、MacOS 和 Windows 的 #1 免费开源 AI 图像放大工具。
InvokeAI
InvokeAI 是领先的开源创意引擎,专为 Stable Diffusion 设计,提供业界领先的 Web UI,用于生成和编辑视觉媒体。