ComfyUI-QwenVL

在ComfyUI里直接跑Qwen-VL,看图看视频出文字

ComfyUI-QwenVL 是一个把通义千问 Qwen-VL 系列多模态大模型接入 ComfyUI 的自定义节点插件。它让原本只擅长图像生成的工作流,直接获得文本生成、图像理解和视频分析能力,用户无需离开 ComfyUI 界面就能调用 Qwen2.5-VL、Qwen3-VL 乃至 MoE 架构的 Qwen3.6-VL 等版本。项目支持 GGUF 量化格式,显著降低显存占用,使消费级显卡也能跑动较大的视觉语言模型。核心能力包括:在节点图中加载 Qwen-VL 模型并输入图片或视频,输出结构化文本描述、问答结果或分析结论;可与文生图、图生图节点串联,实现“先理解再生成”的复合流程。对于想在 ComfyUI 内做多模态推理、自动打标、视频内容解析的创作者,这是一个开箱即用的桥梁型插件。

开源 free 开发框架
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 903
维护状态 较活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类开发框架
开发团队1038lab
所属国家
官网地址
定价模式free
价格说明开源免费,需自行部署ComfyUI使用
访问状态
是否开源是
开源协议GPL-3.0
主要语言Python
技术栈/模型comfyui,customnodes,qwen-vl,qwen3-vl
GitHub 星标★ 903
30天Star增速
HF 下载量
上线时间2025-03-29 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-06
浏览次数0

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

核心亮点

  • 把Qwen-VL多模态能力封装成ComfyUI节点,无需单独部署推理服务
  • 支持GGUF量化,消费级显卡也能加载较大视觉语言模型
  • 覆盖Qwen2.5-VL到Qwen3.8-VL多个版本,含MoE架构,模型选择灵活

不足之处

  • 依赖ComfyUI生态,脱离该平台无法独立使用
  • 多模态模型体积大,实际推理速度和显存占用仍受硬件限制

适用场景

  • 为图像数据集自动生成中文描述和标签
  • 在ComfyUI工作流中先理解参考图再驱动文生图
  • 对短视频做内容摘要或关键帧问答分析

替代项目

ComfyUI-Custom-Scripts、ComfyUI_LLM_party

项目介绍

ComfyUI-QwenVL 是开发框架领域的开源项目,由 1038lab 开发,2025 年首次发布。

在全站 13,752 个收录项目中,它的 GitHub 星标数(903)位列前 30%,在开发框架分类中处于中上游。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-14。开源免费,需自行部署ComfyUI使用。

它主要面向的使用场景是:为图像数据集自动生成中文描述和标签。同类可对比的替代方案包括 ComfyUI-Custom-Scripts、ComfyUI_LLM_party。

上一篇:PromptingTools.jl

下一篇:dsh-codex-subscription

同类项目推荐

dsh-our-free-model 开源

装个插件就能免密钥白嫖前沿大模型,不限量

在 dsh 里装上这个插件即可,无需登录、注册或填 API Key,就能使用包括 DeepSeek V4.1 Fl···

★ 1624 2026-10-04
langchain 开源

组装 AI 应用的乐高积木,从想法到上线不换工具

The agent engineering platform.

★ 147473 2026-08-09
transformers 开源

全球最大的模型仓库全家桶,想用的模型一把抓

Transformers: the model-definition framework for state-of-the-art machine learning m···

★ 166980 2026-08-09