#176 · 主分类: 计算机视觉

ComfyUI-QwenVL

comfyui customnodes qwen-vl qwen3-vl

ComfyUI-QwenVL 自定义节点:集成 Qwen-VL 系列(包括 Qwen2.5-VL、Qwen3-VL、Qwen3.5-VL、Qwen3.6-VL(MoE)和 Qwen3.8-VL),支持 GGUF,用于文本生成、图像理解和视频分析的高级多模态 AI。

项目最后更新:08/27/26

GitHub Stars

864

Forks数量

140

贡献者数量

5

许可证

GPL-3.0

收录理由

对于希望在ComfyUI中不仅生成画面、还能真正读懂画面内容的用户,这个节点可以直接把Qwen-VL系列视觉语言模型接入节点图。它支持图像理解、视频分析和文本生成,GGUF后端让量化模型在显存有限的GPU上也能跑起来。近期的更新里加入了视频自动缩放,会按上下文长度和帧数计算每帧的token预算,很大程度上减少了因上下文溢出或显存不足导致的报错。此外还可以通过配置文件注册自己想要的Hugging Face或GGUF模型。引擎也提供了Python API和命令行工具,在ComfyUI画布之外也能调用,如果审查和修改环节放在其他工具里会很顺手。对于跑多阶段生成和验证流程的团队,这意味着不用切换环境就能加一道视觉语言检查步骤。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目