#132 · 主分类: 图像生成
big-sleep
简单的文本到图像生成命令行工具,使用OpenAI的CLIP和BigGAN。该技术最初由https://twitter.com/advadnoun创建。
项目最后更新:02/06/22
GitHub Stars
2.6K
Forks数量
300
贡献者数量
14
许可证
MIT
收录理由
Big Sleep 把文本提示变成生成图像这件事,简化成了一条终端命令。它把 OpenAI 的 CLIP 和 BigGAN 生成器接在一起,封装了 Ryan Murdock 最初的“深度做梦”思路,让有 GPU 的人不用手动拼装 notebook 单元格就能直接跑。代码量很小,能从头读到尾,想研究文本如何引导生成对抗网络的话,是个不错的参考。仓库还附带了几份 Colab notebook,没有本地硬件也能试着玩。它更像一个参考实现和创意玩具,而不是生产级管线,适合在接触更新模型之前,用来理解提示条件合成的原理。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
stable-diffusion-webui
Stable Diffusion 网页界面
ComfyUI
最强大且模块化的扩散模型GUI、API和后端,具有图形/节点界面。
diffusers
🤗 Diffusers:PyTorch中最先进的扩散模型,用于图像、视频和音频生成。
upscayl
🆙 Upscayl - 适用于 Linux、MacOS 和 Windows 的 #1 免费开源 AI 图像放大工具。
InvokeAI
InvokeAI 是领先的开源创意引擎,专为 Stable Diffusion 设计,提供业界领先的 Web UI,用于生成和编辑视觉媒体。