#81 · 主分类: 图像生成

min-dalle

artificial-intelligence deep-learning pytorch text-to-image

min(DALL·E) 是 DALL·E Mini 到 PyTorch 的快速、极简移植。

项目最后更新:04/28/25

GitHub Stars

3.5K

Forks数量

247

贡献者数量

15

许可证

MIT

收录理由

输入一句自然语言描述,就能得到一组图像,这个项目把 DALL·E Mini 和 Mega 的权重用 PyTorch 重新实现,并精简到只保留推理流程。依赖很少,只有 numpy、requests、pillow 和 torch,装好之后用免费的 Colab GPU 就能跑起来,不必引入沉重的框架。模型只需加载一次,之后可以反复用来生成不同提示词的图片,还提供了 temperature、top-k 以及 supercondition 因子等采样控制项,用来在“贴近文本”和“图像多样性”之间做权衡。渐进式解码输出适合在交互式笔记本里查看,命令行方式则方便批量生成。对于想在本地运行并修改一个紧凑、易读的文本生成图像模型的开发者来说,这是个很直接的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目