图像

汇聚全球AI图像生成与AI绘画项目,收录Midjourney、Stable Diffusion等工具的多维度数据。

共收录 849 个开源项目

TokenCompose 开源

让AI画图不再漏物体,多物体组合更听话

TokenCompose 是一个基于扩散模型的文本到图像生成方法,核心创新在于引入 token 级别的监督信号,···

★ 137 评分 2023-12-03
SLD 开源

让AI画图更听话,大模型自动纠错生成精准图像

SLD是一个由CVPR 2024收录的官方实现项目,提出了一种自校正的大语言模型控制扩散模型方法。它解决···

★ 187 评分 2023-12-03
bingart 开源

用 Python 轻松调用 Bing 的 AI 图像和视频生成能力

BingArt 是一个非官方的异步 Python 封装库,用于调用 Bing 的图像和视频生成接口。它解决了开发者···

★ 58 评分 2023-12-03
attention-map-diffusers 开源

可视化 Stable Diffusion 注意力图,理解 AI 绘画的决策过程

这是一个面向 Hugging Face Diffusers 的注意力图(Attention Map)可视化与分析工具库。它解决了 ···

★ 413 评分 2023-12-02
comfyui-diffusion-cg 开源

在ComfyUI里直接调潜空间色彩,让生成图拥有电影级色调

这是一个为ComfyUI开发的自定义节点集合,核心功能是根据潜空间张量的数值范围进行颜色分级。在Sta···

★ 101 评分 2023-12-01
tryemoji 开源

输入 emoji,几秒生成 AI 艺术画作

tryemoji 是一个利用 AI 将 emoji 转化为艺术画作的开源项目。它基于 Stable Diffusion 和 LCM(潜···

★ 243 评分 2023-11-28
LLMGA 开源

让大模型听懂你的话,自动生成和编辑图像

LLMGA是一个基于多模态大语言模型的图像生成助手,源自ECCV 2024 Oral论文。它旨在解决用户难以精确···

★ 395 评分 2023-11-27
SeeSR 开源

用扩散模型和语义提示,让模糊图片恢复清晰细节

SeeSR 是一个基于语义感知的真实世界图像超分辨率模型,来自 CVPR 2024。它针对现有超分方法在复杂···

★ 657 评分 2023-11-27
DeTikZify 开源

上传图表或草图,秒变可编译的TikZ矢量代码。

DeTikZify是一个将科学图表和手绘草图自动转换为TikZ代码的开源AI模型。它解决了科研人员在撰写LaT···

★ 1818 评分 2023-11-27
comfyui-browser 开源

给 ComfyUI 装个素材管理器,找图、找视频、找工作流快十倍。

comfyui-browser 是一个专为 ComfyUI 设计的图像、视频和工作流浏览器及管理器。它解决了 ComfyUI ···

★ 678 评分 2023-11-26
comflowyspace 开源

不用学节点,像用美图秀秀一样玩转 AI 绘画和视频

Comflowyspace 是一个面向普通用户的开源 AI 图像与视频生成工具,旨在降低 ComfyUI 的使用门槛。它···

★ 2347 评分 2023-11-25
partcraft 开源

像拼乐高一样,用部件拼出你想要的任何物体!

PartCraft是一个基于扩散模型的细粒度图像生成项目,来自ECCV 2024。它解决的是传统文本生成图像模···

★ 103 评分 2023-11-23
DreamWire 开源

上传场景,AI 自动生成多视角艺术线稿

DreamWire 是一个基于生成式 AI 的多视角线艺(Wire Art)创作工具,源自 CVPR 2024 论文。它解决的···

★ 88 评分 2023-11-21
comflowy 开源

让 ComfyUI 和 Stable Diffusion 变得简单好用,快速生成惊艳图像

Comflowy 是一个围绕 ComfyUI 和 Stable Diffusion 打造的开源工具与社区平台,旨在降低 AI 图像生···

★ 1200 评分 2023-11-20
TheChosenOne 开源

上传一张角色图,生成风格统一的多张角色图像

TheChosenOne 是论文《The Chosen One: Consistent Characters in Text-to-Image Diffusion Models···

★ 270 评分 2023-11-19
dalle3-playground 开源

打开网页就能玩 DALL·E 3,不用写代码

这是一个非官方的 DALL·E 3 在线游乐场,基于 TypeScript 开发,用于快速体验 OpenAI 图像生成 AP···

★ 94 评分 2023-11-16
a-person-mask-generator 开源

一键自动抠出人物各部位,轻松实现局部重绘和换装。

这是一个为 Stable Diffusion 生态(Automatic1111 WebUI 和 ComfyUI)设计的扩展插件,用于在图像···

★ 406 评分 2023-11-16
Jovimetrix 开源

用波形驱动参数,让 ComfyUI 动画生成更简单

Jovimetrix 是一个基于 ComfyUI 的扩展节点包,专注于通过波形调制和数学运算实现动画参数控制。它···

★ 397 评分 2023-11-16
sd-webui-semantic-guidance 开源

给Stable Diffusion加语义方向盘,用文字微调图像细节

这是一个为 Stable Diffusion WebUI 开发的扩展,非官方实现了 SEGA(语义引导)技术。SEGA 允许用···

★ 68 评分 2023-11-09
sd-webui-replacer 开源

用一句话描述,在图片或视频里自动替换指定物体,无需手动抠图。

sd-webui-replacer 是一个面向 Stable Diffusion WebUI 的扩展插件,主要解决图像或视频中特定物体···

★ 241 评分 2023-11-06
cross-image-attention 开源

零训练,用注意力机制把参考图外观迁移到任意目标图

Cross-Image Attention 是论文《Cross-Image Attention for Zero-Shot Appearance Transfer》的官方···

★ 404 评分 2023-11-04
Fooocus-zh 开源

给 Fooocus 装上中文皮肤,AI 绘画更顺手

Fooocus-zh 是开源 AI 图像生成工具 Fooocus 的中文汉化补丁项目,旨在解决 Fooocus 界面与文档对中···

★ 111 评分 2023-11-01
DemoFusion 开源

用低显存生成高分辨率图像,细节更丰富

DemoFusion是一个旨在普及高分辨率图像生成的开源项目,由CVPR 2024收录。它解决了在有限GPU资源下···

★ 2038 评分 2023-10-29
ComfyUI_ExtraModels 开源

在 ComfyUI 里一键跑通 DiT、PixArt 等新模型

ComfyUI_ExtraModels 是一个为 ComfyUI 扩展额外图像生成模型支持的插件。它解决了 ComfyUI 原生仅···

★ 536 评分 2023-10-20