#176 · 主分类: 计算机视觉
ComfyUI-QwenVL
ComfyUI-QwenVL 自定义节点:集成 Qwen-VL 系列(包括 Qwen2.5-VL、Qwen3-VL、Qwen3.5-VL、Qwen3.6-VL(MoE)和 Qwen3.8-VL),支持 GGUF,用于文本生成、图像理解和视频分析的高级多模态 AI。
项目最后更新:08/27/26
GitHub Stars
864
Forks数量
140
贡献者数量
5
许可证
GPL-3.0
收录理由
对于希望在ComfyUI中不仅生成画面、还能真正读懂画面内容的用户,这个节点可以直接把Qwen-VL系列视觉语言模型接入节点图。它支持图像理解、视频分析和文本生成,GGUF后端让量化模型在显存有限的GPU上也能跑起来。近期的更新里加入了视频自动缩放,会按上下文长度和帧数计算每帧的token预算,很大程度上减少了因上下文溢出或显存不足导致的报错。此外还可以通过配置文件注册自己想要的Hugging Face或GGUF模型。引擎也提供了Python API和命令行工具,在ComfyUI画布之外也能调用,如果审查和修改环节放在其他工具里会很顺手。对于跑多阶段生成和验证流程的团队,这意味着不用切换环境就能加一道视觉语言检查步骤。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。