#285 · 主分类: 计算机视觉

ComfyUI_SLK_joy_caption_two

ComfyUI 节点

项目最后更新:06/18/25

GitHub Stars

723

Forks数量

44

贡献者数量

3

许可证

GPL-3.0

收录理由

在ComfyUI里整理图像数据集时,这个节点能直接完成打标工作,省去切换工具的麻烦。它封装了JoyCaptionAlpha Two模型,该模型结合了SigLIP视觉编码器和Llama 3.1指令模型,生成的描述是自然语句,而不是干巴巴的关键词标签。批量节点是多数人最关心的部分:能处理整个文件夹的图片,支持在每条描述前后追加文本(训练时注入触发词很方便),还开放了top_p和temperature参数来控制采样。安装时需要手动下载JoyCaption模型和兼容的LLM,放到ComfyUI对应的模型目录里,不过README对每一步路径都写得很清楚。对于想在现有ComfyUI流程中集成打标功能的数据集构建者来说,这是个很实在的选择。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目