#282 · 主分类: 计算机视觉
ComfyUI_Qwen3-VL-Instruct
成功将Qwen3-VL-Instruct系列集成到ComfyUI平台,实现流畅运行,支持(但不限于)文本查询、视频查询、单图查询和多图查询,用于生成标题或回复。
项目最后更新:10/23/25
GitHub Stars
581
Forks数量
63
贡献者数量
4
许可证
Apache-2.0
收录理由
在ComfyUI的节点式工作流里直接调用Qwen3-VL-Instruct系列模型,这个自定义节点把视觉语言能力带进了原本只处理图像生成的画布。它接受文本、单图、多图或视频作为输入,输出对应的描述或回答,让视觉理解结果能无缝接入更大的处理流程,不必再切换到外部工具。仓库自带的示例工作流覆盖了四种查询模式,模型也会在首次运行时自动下载,省去手动找模型的麻烦。对于需要在ComfyUI内完成图像打标、视频内容概括的团队,这是个很实用的补充。唯一要提前留意的是,查看输出可能需要作者另一个MiniCPM-V插件里附带的Display Text节点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。