#109 · 主分类: 图像生成

Dreambooth-Stable-Diffusion

ai artificial-intelligence image-generation img2img latent-diffusion machine-learning model-training stable-diffusion txt2img

通过文本反转(https://arxiv.org/abs/2208.01618)实现Dreambooth(https://arxiv.org/abs/2208.12242),用于Stable Diffusion(https://arxiv.org/abs/2112.10752)。针对训练人脸、物体和风格的调整。

项目最后更新:01/08/24

GitHub Stars

3.2K

Forks数量

526

贡献者数量

18

许可证

MIT

收录理由

这套训练工具让 Stable Diffusion 模型学会辨认并重现特定的面孔、物体或视觉风格,把 Dreambooth 与 Textual Inversion 两条技术路线整合到同一条流程里,用少量个人图片就能微调模型。它的优化重点在于让脸和物体保持可辨识度,而不是输出千篇一律的模糊结果。项目附带了云端 GPU 服务和本地机器的搭建指南,没有微调经验也能上手。作者 Joe Penna 是电影导演,最初是为了给影片训练演员、道具和场景才写了这个仓库,所以调试笔记里针对常见失败情形讲得很实在,比如生成的脸完全不像原图,或者训练图片被生硬复刻。想要稳定复现某个角色或特定画风、而不是得到泛化输出的话,这里的训练代码和排查思路都能派上用场。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目