TokenCompose
开源
让AI画图不再漏物体,多物体组合更听话
TokenCompose 是一个基于扩散模型的文本到图像生成方法,核心创新在于引入 token 级别的监督信号,···
汇聚全球AI图像生成与AI绘画项目,收录Midjourney、Stable Diffusion等工具的多维度数据。
共收录 849 个开源项目
TokenCompose
开源
让AI画图不再漏物体,多物体组合更听话
TokenCompose 是一个基于扩散模型的文本到图像生成方法,核心创新在于引入 token 级别的监督信号,···
SLD
开源
让AI画图更听话,大模型自动纠错生成精准图像
SLD是一个由CVPR 2024收录的官方实现项目,提出了一种自校正的大语言模型控制扩散模型方法。它解决···
bingart
开源
用 Python 轻松调用 Bing 的 AI 图像和视频生成能力
BingArt 是一个非官方的异步 Python 封装库,用于调用 Bing 的图像和视频生成接口。它解决了开发者···
attention-map-diffusers
开源
可视化 Stable Diffusion 注意力图,理解 AI 绘画的决策过程
这是一个面向 Hugging Face Diffusers 的注意力图(Attention Map)可视化与分析工具库。它解决了 ···
comfyui-diffusion-cg
开源
在ComfyUI里直接调潜空间色彩,让生成图拥有电影级色调
这是一个为ComfyUI开发的自定义节点集合,核心功能是根据潜空间张量的数值范围进行颜色分级。在Sta···
tryemoji
开源
输入 emoji,几秒生成 AI 艺术画作
tryemoji 是一个利用 AI 将 emoji 转化为艺术画作的开源项目。它基于 Stable Diffusion 和 LCM(潜···
LLMGA
开源
让大模型听懂你的话,自动生成和编辑图像
LLMGA是一个基于多模态大语言模型的图像生成助手,源自ECCV 2024 Oral论文。它旨在解决用户难以精确···
SeeSR
开源
用扩散模型和语义提示,让模糊图片恢复清晰细节
SeeSR 是一个基于语义感知的真实世界图像超分辨率模型,来自 CVPR 2024。它针对现有超分方法在复杂···
DeTikZify
开源
上传图表或草图,秒变可编译的TikZ矢量代码。
DeTikZify是一个将科学图表和手绘草图自动转换为TikZ代码的开源AI模型。它解决了科研人员在撰写LaT···
comfyui-browser
开源
给 ComfyUI 装个素材管理器,找图、找视频、找工作流快十倍。
comfyui-browser 是一个专为 ComfyUI 设计的图像、视频和工作流浏览器及管理器。它解决了 ComfyUI ···
comflowyspace
开源
不用学节点,像用美图秀秀一样玩转 AI 绘画和视频
Comflowyspace 是一个面向普通用户的开源 AI 图像与视频生成工具,旨在降低 ComfyUI 的使用门槛。它···
partcraft
开源
像拼乐高一样,用部件拼出你想要的任何物体!
PartCraft是一个基于扩散模型的细粒度图像生成项目,来自ECCV 2024。它解决的是传统文本生成图像模···
DreamWire
开源
上传场景,AI 自动生成多视角艺术线稿
DreamWire 是一个基于生成式 AI 的多视角线艺(Wire Art)创作工具,源自 CVPR 2024 论文。它解决的···
comflowy
开源
让 ComfyUI 和 Stable Diffusion 变得简单好用,快速生成惊艳图像
Comflowy 是一个围绕 ComfyUI 和 Stable Diffusion 打造的开源工具与社区平台,旨在降低 AI 图像生···
TheChosenOne
开源
上传一张角色图,生成风格统一的多张角色图像
TheChosenOne 是论文《The Chosen One: Consistent Characters in Text-to-Image Diffusion Models···
dalle3-playground
开源
打开网页就能玩 DALL·E 3,不用写代码
这是一个非官方的 DALL·E 3 在线游乐场,基于 TypeScript 开发,用于快速体验 OpenAI 图像生成 AP···
a-person-mask-generator
开源
一键自动抠出人物各部位,轻松实现局部重绘和换装。
这是一个为 Stable Diffusion 生态(Automatic1111 WebUI 和 ComfyUI)设计的扩展插件,用于在图像···
Jovimetrix
开源
用波形驱动参数,让 ComfyUI 动画生成更简单
Jovimetrix 是一个基于 ComfyUI 的扩展节点包,专注于通过波形调制和数学运算实现动画参数控制。它···
sd-webui-semantic-guidance
开源
给Stable Diffusion加语义方向盘,用文字微调图像细节
这是一个为 Stable Diffusion WebUI 开发的扩展,非官方实现了 SEGA(语义引导)技术。SEGA 允许用···
sd-webui-replacer
开源
用一句话描述,在图片或视频里自动替换指定物体,无需手动抠图。
sd-webui-replacer 是一个面向 Stable Diffusion WebUI 的扩展插件,主要解决图像或视频中特定物体···
cross-image-attention
开源
零训练,用注意力机制把参考图外观迁移到任意目标图
Cross-Image Attention 是论文《Cross-Image Attention for Zero-Shot Appearance Transfer》的官方···
Fooocus-zh
开源
给 Fooocus 装上中文皮肤,AI 绘画更顺手
Fooocus-zh 是开源 AI 图像生成工具 Fooocus 的中文汉化补丁项目,旨在解决 Fooocus 界面与文档对中···
DemoFusion
开源
用低显存生成高分辨率图像,细节更丰富
DemoFusion是一个旨在普及高分辨率图像生成的开源项目,由CVPR 2024收录。它解决了在有限GPU资源下···
ComfyUI_ExtraModels
开源
在 ComfyUI 里一键跑通 DiT、PixArt 等新模型
ComfyUI_ExtraModels 是一个为 ComfyUI 扩展额外图像生成模型支持的插件。它解决了 ComfyUI 原生仅···