#128 · 主分类: 图像生成
ComfyUI-Gemini
在ComfyUI中使用Gemini
项目最后更新:05/22/24
GitHub Stars
788
Forks数量
66
贡献者数量
1
许可证
GPL-3.0
收录理由
这个自定义节点包把 Google 的 Gemini 模型接进了 ComfyUI,装上之后就能在节点图里直接生成提示词、描述图像,还能跟模型进行多轮对话。它覆盖了纯文本的 Gemini Pro、带视觉能力的 Pro Vision,以及更新的 1.5 Pro——后者支持系统指令,也能上传单个文件,包括音频、PDF 和文本。如果你平时训练 LoRA,批量打标的工作流会很顺手,因为 Gemini Pro Vision 可以自动给图片打标签。另外,API 密钥可以设成环境变量,这样分享工作流时不会把密钥泄露出去。整体来看,这是在现有图像生成流程里接入一个外部大模型的干净做法。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
stable-diffusion-webui
Stable Diffusion 网页界面
ComfyUI
最强大且模块化的扩散模型GUI、API和后端,具有图形/节点界面。
diffusers
🤗 Diffusers:PyTorch中最先进的扩散模型,用于图像、视频和音频生成。
upscayl
🆙 Upscayl - 适用于 Linux、MacOS 和 Windows 的 #1 免费开源 AI 图像放大工具。
InvokeAI
InvokeAI 是领先的开源创意引擎,专为 Stable Diffusion 设计,提供业界领先的 Web UI,用于生成和编辑视觉媒体。