ALDM
开源
让AI画图严格听话,布局指哪打哪
ALDM 是 ICLR 2024 论文《Adversarial Supervision Makes Layout-to-Image Diffusion Models Thriv···
汇聚全球AI图像生成与AI绘画项目,收录Midjourney、Stable Diffusion等工具的多维度数据。
共收录 849 个开源项目
ALDM
开源
让AI画图严格听话,布局指哪打哪
ALDM 是 ICLR 2024 论文《Adversarial Supervision Makes Layout-to-Image Diffusion Models Thriv···
ComfyUI-PhotoMaker-ZHO
开源
拖拽节点,用几张照片生成定制人物图像
ComfyUI-PhotoMaker-ZHO 是 PhotoMaker 的 ComfyUI 非官方实现,将 PhotoMaker 的个性化图像生成能···
ComfyUI-TiledDiffusion
开源
大图生成不爆显存,细节更丰富
ComfyUI-TiledDiffusion 是一个为 ComfyUI 设计的插件,主要用于解决 Stable Diffusion 生成大尺寸···
sd-webui-lama-cleaner-masked-content
开源
先用LAMA预填充蒙版,再让SD精修,修复更自然
这是一个 Stable Diffusion WebUI 的扩展插件,核心功能是在图生图(Inpainting)之前,先用 LAMA ···
Draw2Img
开源
画一笔、输句话,即刻生成新图像
Draw2Img 是一个基于 Vue 构建的简易 Web 界面,专注于交互式文本引导的图像生成与编辑。它解决了非···
transformer_latent_diffusion
开源
用Transformer替换U-Net,探索扩散模型新架构
这是一个基于Transformer核心的文本到图像潜在扩散模型实现,旨在探索用Transformer替代传统U-Net作···
ComfyUI_Ib_CustomNodes
开源
从路径直接加载图像,增强 ComfyUI 图像处理流程
ComfyUI_Ib_CustomNodes 是一个为 ComfyUI 开发的自定义节点集合,主要提供增强版的“从路径加载图···
ComfyUI-ArtGallery
开源
把 ComfyUI 生成图变成可回溯的灵感画廊,一键复用提示词
ComfyUI-ArtGallery 是一个面向 ComfyUI 的提示词可视化扩展,它将用户的 Stable Diffusion 生成作···
Text-To-Material-Unity
开源
在Unity里输入文字,一键生成材质,告别手动调参。
Text-To-Material-Unity 是一个面向 Unity 引擎的开源工具,允许开发者通过自然语言文本提示直接生···
Canvas
开源
在 Mac 上原生玩转 DALL·E,输入文字秒出图
Canvas 是一款专为 Mac 打造的 DALL·E 图像生成客户端,本质上是 OpenAI 图像生成模型的本地游乐场···
com.doji.diffusers
开源
在Unity里直接跑Stable Diffusion,无需后端
这是一个Unity包,用于通过Unity Sentis在Unity引擎中运行预训练的扩散模型(如Stable Diffusion)···
comfyui-resharpen
开源
在 ComfyUI 里直接给图像加细节或磨皮,无需外部软件。
comfyui-resharpen 是一个为 ComfyUI 设计的自定义节点,用于在图像生成工作流中精细化调整图像的细···
the-og
开源
用纯 PHP 快速生成社交分享预览图,自托管零依赖
the-og 是一个纯 PHP 实现的 OpenGraph 图片生成器,用于动态生成社交媒体分享链接时所需的预览图片···
SUPIR
开源
一键将模糊老照片修复成高清逼真大片
SUPIR 是一个面向真实世界图像修复的开源项目,旨在通过深度学习算法将低质量、模糊或有噪声的照片···
StableDiffusion.NET
开源
在 C# 里直接跑 Stable Diffusion,无需 Python 环境
StableDiffusion.NET 是一个面向 C# 开发者的 Stable Diffusion 封装库,基于 stable-diffusion.cp···
turbo-art
开源
用SDXL Turbo秒速出图,实时探索创意灵感
turbo-art 是一个基于 SDXL Turbo 模型的创意探索游乐场,旨在让用户通过简单的交互快速体验实时图···
DiffMorpher
开源
用扩散模型让两张图丝滑变形,生成高质量过渡视频
DiffMorpher 是 CVPR 2024 的官方实现,旨在利用扩散模型的能力实现高质量的图像变形(morphing)。···
star-vector
开源
上传图片或输入文字,一键生成可编辑的 SVG 矢量图
StarVector 是一个用于 SVG 生成的基础模型,它将矢量图转换任务重构为代码生成任务。基于视觉-语言···
ai_webui
开源
一个界面搞定图像、音频、视频 AI 处理,无需代码。
ai_webui 是一个面向 AI 创作场景的通用 Web 界面,旨在将图像、音频、视频等 AI 处理能力整合到统···
interactdiffusion
开源
一句话控制图像中物体交互关系,生成自然互动画面
InteractDiffusion 是 CVPR 2024 的官方实现,旨在解决文本到图像扩散模型中的交互控制问题。传统模···
FontDiffuser
开源
一个参考字,AI帮你生成整套同风格字体
FontDiffuser 是一个基于扩散模型的一次性字体生成开源项目,发表于 AAAI 2024。它解决的是少样本场···
EpiDiff
开源
单图生成多视角,极线约束保一致,3D重建更高效
EpiDiff 是一个基于扩散模型的多视角合成框架,旨在从单张图片生成高一致性的多视角图像,进而用于···
PowerPaint
开源
一个模型搞定图像修补:插入、移除、外扩、形状生成全支持
PowerPaint 是一个基于 Stable Diffusion 的高质量多功能图像修补模型,由上海AI实验室等机构在 EC···
comfyui-lama-remover
开源
在 ComfyUI 里一键擦除图像中不想要的物体,自动补全背景。
这是一个用于 ComfyUI 的 Lama 图像修复/移除插件,基于 LaMa 模型实现图像中物体的快速移除与背景···