#109 · 主分类: 图像生成
Dreambooth-Stable-Diffusion
通过文本反转(https://arxiv.org/abs/2208.01618)实现Dreambooth(https://arxiv.org/abs/2208.12242),用于Stable Diffusion(https://arxiv.org/abs/2112.10752)。针对训练人脸、物体和风格的调整。
项目最后更新:01/08/24
GitHub Stars
3.2K
Forks数量
526
贡献者数量
18
许可证
MIT
收录理由
这套训练工具让 Stable Diffusion 模型学会辨认并重现特定的面孔、物体或视觉风格,把 Dreambooth 与 Textual Inversion 两条技术路线整合到同一条流程里,用少量个人图片就能微调模型。它的优化重点在于让脸和物体保持可辨识度,而不是输出千篇一律的模糊结果。项目附带了云端 GPU 服务和本地机器的搭建指南,没有微调经验也能上手。作者 Joe Penna 是电影导演,最初是为了给影片训练演员、道具和场景才写了这个仓库,所以调试笔记里针对常见失败情形讲得很实在,比如生成的脸完全不像原图,或者训练图片被生硬复刻。想要稳定复现某个角色或特定画风、而不是得到泛化输出的话,这里的训练代码和排查思路都能派上用场。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
stable-diffusion-webui
Stable Diffusion 网页界面
ComfyUI
最强大且模块化的扩散模型GUI、API和后端,具有图形/节点界面。
diffusers
🤗 Diffusers:PyTorch中最先进的扩散模型,用于图像、视频和音频生成。
upscayl
🆙 Upscayl - 适用于 Linux、MacOS 和 Windows 的 #1 免费开源 AI 图像放大工具。
InvokeAI
InvokeAI 是领先的开源创意引擎,专为 Stable Diffusion 设计,提供业界领先的 Web UI,用于生成和编辑视觉媒体。