GitHub Stars
723
Forks数量
44
贡献者数量
3
许可证
GPL-3.0
收录理由
在ComfyUI里整理图像数据集时,这个节点能直接完成打标工作,省去切换工具的麻烦。它封装了JoyCaptionAlpha Two模型,该模型结合了SigLIP视觉编码器和Llama 3.1指令模型,生成的描述是自然语句,而不是干巴巴的关键词标签。批量节点是多数人最关心的部分:能处理整个文件夹的图片,支持在每条描述前后追加文本(训练时注入触发词很方便),还开放了top_p和temperature参数来控制采样。安装时需要手动下载JoyCaption模型和兼容的LLM,放到ComfyUI对应的模型目录里,不过README对每一步路径都写得很清楚。对于想在现有ComfyUI流程中集成打标功能的数据集构建者来说,这是个很实在的选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。