diffusers
本站收录 58 个带「diffusers」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
inferenceXinference 是一个统一推理引擎,旨在解决多模型部署与调用碎片化问题。它允许开发者通过修改一行代码,将 GPT 替换为任何开源大语言模型、语音模型或多模★ 9,593
sdnextSD.Next:一站式 AI 生成图像与视频的 WebUI,集生成、打标与后期处理于一体,在 A1111 基础上持续进化,功能全面、社区活跃,是追求全能与稳定的★ 7,349
FastVideo统一的视频生成加速框架,将推理与后训练(post-training)流程整合一体,通过高效优化实现更快的视频生成速度,降低训练与推理成本,适合研究团队与工程部署★ 4,521
riffusion-hobbyriffusion-hobby 是一个基于 Stable Diffusion 的音乐生成开源项目,将图像生成技术应用于音频频谱图,实现实时音乐创作。它解决了传统★ 3,900
SimpleTunerSimpleTuner 是一个面向扩散模型的通用微调工具包,支持图像、视频和音频扩散模型的定制训练。它解决了扩散模型在特定数据集上微调时配置复杂、流程繁琐的问题★ 2,930
InfiniteYouInfiniteYou 是一个基于扩散模型的图像生成与编辑工具,核心解决身份保持下的灵活照片重绘问题。它允许用户在不丢失人物身份特征的前提下,对照片进行多种编辑★ 2,683
nndeploynndeploy 是一款专注于 AI 模型部署的 C++ 框架,旨在解决深度学习模型从训练到生产环境落地时面临的碎片化问题。它提供统一的推理接口,屏蔽了不同后端★ 1,882
stable-faststable-fast 是一个专为 NVIDIA GPU 设计的 HuggingFace Diffusers 推理性能优化框架,由 WaveSpeed.ai 团★ 1,304
prunaPruna 是一个面向开发者的模型优化框架,旨在以最小的工作量让 AI 模型运行得更快、更高效。它主要解决深度学习模型在推理阶段的性能瓶颈问题,通过组合多种优化★ 1,303
sd-webui-inpaint-anythingsd-webui-inpaint-anything 是一个基于 Stable Diffusion WebUI 的扩展,它将 Segment Anything 的★ 1,295
binioubiniou 是一个自托管的 WebUI,聚合了 30 多种生成式 AI 模型,覆盖图像、音频、视频等模态。它基于 Gradio 构建,集成 Hugging F★ 1,151
Real-Time-Latent-Consistency-Model这是一个展示多种实时扩散模型管线的开源应用,基于 Diffusers 库实现。它主要解决传统 Stable Diffusion 推理速度慢、难以用于实时交互场景★ 914
Lora-for-Diffusers这是一个面向AI图像生成研究者的LoRA微调教程项目,旨在用最易懂的方式讲解如何在diffusers框架中使用LoRA(低秩适配)技术。项目解决了Stable ★ 822
Flow-FactoryFlow-Factory 是一个面向 Flow-Matching 模型的统一强化学习框架,旨在简化基于流匹配的生成模型(如扩散模型)中的强化学习训练流程。它解决★ 712
Text-To-Video-FinetuningText-To-Video-Finetuning 是一个基于 Python 的开源项目,旨在帮助开发者对 ModelScope 的文本生成视频模型进行微调。它利★ 704
optimum-intelOptimum Intel 是 Hugging Face 与 Intel 合作推出的优化工具库,旨在通过 Intel 的 OpenVINO 等工具加速 Tran★ 624
FontDiffuserFontDiffuser 是一个基于扩散模型的一次性字体生成开源项目,发表于 AAAI 2024。它解决的是少样本场景下的字体风格迁移问题,即仅凭一个参考字符,★ 565
Open-OmniVCusOmniVCus 是一个面向视频定制生成的开源项目,基于扩散模型(Diffusion Models)和 Transformer 架构,支持通过多模态控制条件(如★ 495
comfyui_HiDream-Samplercomfyui_HiDream-Sampler 是一个为 ComfyUI 开发的 HiDream 模型自定义节点插件,旨在将 HiDream 图像生成模型无缝集★ 477
ADI-Stable-DiffusionADI-Stable-Diffusion 是一个基于 C++ 和 ONNXRuntime 的 Stable Diffusion 推理加速库,旨在解决 Pytho★ 447
Auto1111SDKAuto1111SDK 是一个面向 Automatic1111 WebUI 的 Python SDK 库,旨在为开发者提供简洁、稳定的编程接口来运行先进的扩散模★ 414
attention-map-diffusers这是一个面向 Hugging Face Diffusers 的注意力图(Attention Map)可视化与分析工具库。它解决了 Stable Diffusio★ 413
diffusers.jsdiffusers.js 是 Hugging Face diffusers 库的 JavaScript/TypeScript 实现,目标是在 Node.js 和★ 352
dfserverdfserver 是一个用 Go 语言编写的分布式后端 AI 流水线服务器,专注于图像生成场景。它解决了 Stable Diffusion 等 AI 绘画模型在★ 343
stable-diffusion-colabstable-diffusion-colab 是一个基于 Google Colab 的 Jupyter Notebook 项目,专门用于运行 Stable Di★ 322
g-diffuser-botg-diffuser-bot 是一个基于 Python 的 Discord 机器人,为 Stable Diffusion 提供交互界面。它解决了在 Discor★ 282
diffusers-interpretDiffusers-Interpret 是一个面向 Hugging Face Diffusers 模型的可解释性工具库,旨在帮助开发者和研究者理解扩散模型生成图★ 277
inpaint-anythingInpaint Anything 是一个基于浏览器的图像修复工具,它将 Meta 的 Segment Anything 模型(SAM)与 Stable Diff★ 274
instruction-tuned-sdinstruction-tuned-sd 是一个用于对 Stable Diffusion 进行指令微调(instruction tuning)的开源项目。它解决★ 250
FreeFuseFreeFuse 是一个用于多主体 LoRA 融合的图像生成工具,解决在测试时(推理阶段)将多个 LoRA 模型动态组合到单个图像生成中的问题。它基于自适应 t★ 243
DiLightNetDiLightNet 是 SIGGRAPH 2024 的官方开源项目,专注于扩散模型的细粒度光照控制。它解决了现有图像生成模型难以精确控制光照方向和强度的问题,★ 213
consistency-modelsconsistency-models 是 OpenAI 官方发布的用于训练和采样一致性模型的工具包。一致性模型是一种新型的生成模型,旨在解决传统扩散模型采样速度★ 207
docker-diffusers-api这是一个将 Hugging Face Diffusers 和 Stable Diffusion 模型打包进 Docker 容器,并对外提供 REST API 的★ 204
Diffusion_models_tutorial这是一个扩散模型的系统教程集合,以Jupyter Notebook为载体,从零开始逐步实现扩散模型。项目覆盖了去噪扩散概率模型(DDPM)和基于分数的生成模型等★ 185
caption-upsamplingcaption-upsampling 是一个基于 PyTorch 和 diffusers 的开源项目,旨在复现 DALL-E 3 中的“标题上采样”(capti★ 157
Qwen-Image-Edit-2511-LoRAs-Fast-Lazy-Load这是一个针对Qwen-Image-Edit-2511图像编辑模型的演示项目,核心亮点是支持懒加载的LoRA适配器,用于高级单图和多图编辑。项目集成了7种以上专用★ 154
zero123-hfzero123-hf 是 Zero-1-to-3 模型的 diffusers 实现,该模型在 ICCV 2023 上提出,核心能力是从单张 RGB 图像零样本生★ 154
StableDiffusionTelegramStableDiffusionTelegram 是一个将 Stable Diffusion 图像生成能力集成到 Telegram 聊天机器人的开源项目。它解决了★ 130
diffusionmagicdiffusionmagic 是一个基于 Hugging Face diffusers 库的 Stable Diffusion 工作流封装项目,旨在降低图像生成★ 123
Cozy-Auto-TextureCozy-Auto-Texture 是一个 Blender 插件,利用 Stable Diffusion 文本生成图像模型,直接在 Blender 内生成免费纹★ 117
SPRIGHTSPRIGHT 是 ECCV 2024 收录的官方 PyTorch 实现,旨在解决文本到图像模型中的空间一致性不足问题。现有模型(如 Stable Diffus★ 106
NeuroSandboxWebUINeuroSandboxWebUI 是一个本地运行的神经网络模型 WebUI,基于 Python 和 Gradio 构建,支持文本、图像、视频、3D 和音频等多★ 106
worker-a1111worker-a1111 是一个基于 RunPod 的 serverless 工作节点,用于在云端无服务器环境中运行 AUTOMATIC1111 的 Stabl★ 99
controlnetvideocontrolnetvideo 是一个将 ControlNet 应用于视频片段的开源工具,旨在解决 ControlNet 在视频序列中逐帧应用时产生的闪烁和风格★ 84
openjourneyOpenJourney 是一个基于 Stable Diffusion 微调的开源图像生成模型,旨在让用户无需付费订阅 Midjourney 即可生成类似其艺术风★ 81
svd-mvsvd-mv 是 Stable Video Diffusion Multi-View 的非官方实现,旨在利用预训练的 Stable Video Diffusio★ 79
PicPilotPicPilot 是一个基于 Python 的图像生成工具,旨在帮助品牌快速创建视觉内容。它利用 Stable Diffusion 和 Transformers★ 74