ComfyUI-Gemini

在 ComfyUI 里直接调用 Gemini,让多模态 AI 助力图像创作。

ComfyUI-Gemini 是一个将 Google Gemini 多模态模型集成到 ComfyUI 工作流中的插件。它解决了 ComfyUI 用户无法直接利用 Gemini 进行图像理解、生成和编辑的问题,让用户可以在熟悉的节点式界面中调用 Gemini 的能力。核心能力包括:使用 Gemini Pro Vision 对图像进行描述、分析,生成提示词;利用 Gemini 生成图像(通过 Imagen 或图像编辑);以及将 Gemini 作为节点与其他 Stable Diffusion 模型结合,实现更复杂的创意流程。该项目通过自定义节点封装 API,简化了调用过程,使得 AI 创作者无需编写代码即可将 Gemini 融入生成式工作流。

开源 free 图像生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 783
维护状态 低维护
是否开源
定价模式 free

项目数据

分类图像生成
开发团队ZHO-ZHO-ZHO
所属国家
官网地址
定价模式free
价格说明开源项目,GPL-3.0许可,可自行部署使用,无付费版本。
访问状态
是否开源
开源协议GPL-3.0
主要语言Python
技术栈/模型comfyui,gemini-pro,google-gemini,stable-diffusion
GitHub 星标★ 783
30天Star增速
HF 下载量
上线时间2023-12-19 00:00:00
最近更新2026-09-23 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

核心亮点

  • 无缝集成 ComfyUI,通过节点拖拽即可使用 Gemini,无需编程
  • 支持图像理解与提示词生成,可辅助 Stable Diffusion 提升出图质量
  • 支持 Gemini 图像生成与编辑,扩展了 ComfyUI 的多模态能力

不足之处

  • 依赖 Google API 密钥,需要付费或申请额度,且网络访问受限
  • 文档/社区待观察

适用场景

  • 在 ComfyUI 工作流中自动为输入图像生成详细提示词
  • 使用 Gemini 对生成结果进行质量评估或内容分析
  • 结合 Stable Diffusion 与 Gemini 实现图像编辑或风格转换

替代项目

ComfyUI-OpenAI、ComfyUI-Claude、ComfyUI-Llama

项目介绍

ComfyUI-Gemini 是开发框架领域的开源项目,由 ZHO-ZHO-ZHO 开发,2023 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(783)位列前 30%,在开发框架分类中处于中上游。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-23。GPL-3.0许可,可自行部署使用,无付费版本。

它主要面向的使用场景是:在ComfyUI工作流中自动为输入图像生成详细提示词。同类可对比的替代方案包括 ComfyUI-OpenAI、ComfyUI-Claude、ComfyUI-Llama。

上一篇:SeargeSDXL

下一篇:ComfyScript

同类项目推荐

langchain 开源

组装 AI 应用的乐高积木,从想法到上线不换工具

The agent engineering platform.

★ 146874 2026-08-09
transformers 开源

全球最大的模型仓库全家桶,想用的模型一把抓

Transformers: the model-definition framework for state-of-the-art machine learning m···

★ 166529 2026-08-09
pi 开源

一套 TypeScript 工具包,快速搭出能写代码的 AI agent

AI agent toolkit: unified LLM API, agent loop, TUI, coding agent CLI

★ 108504 2026-09-12