latent-diffusion

本站收录 34 个带「latent-diffusion」标签的 AI 开源项目

InvokeAI面向 Stable Diffusion 模型的领先创意引擎,服务专业设计师、艺术家与爱好者,提供业界一流的 WebUI 与最新的 AI 视觉生成技术,让从灵感到★ 28,313IOPaint基于 SOTA AI 模型的图像修复工具,可一键移除照片中任何不想要的物体、瑕疵或人物,支持擦除与替换(由 Stable Diffusion 驱动),本地部署即★ 23,313stable-diffusion.cpp纯 C/C++ 实现的扩散模型推理库,无需 Python 环境即可运行 SD、Flux、Wan、Qwen Image、Z-Image 等主流模型,性能卓越、部署★ 7,469StyleTTS2StyleTTS 2 通过风格扩散与对抗训练,结合大型语音语言模型,实现了接近人类水平的文本转语音。合成语音的自然度与韵律表现力出众,即使无参考语音也能生成高质★ 6,361discoartdiscoart 是一个用 Python 编写的开源工具,旨在通过一行代码简化 Disco Diffusion 艺术作品的创作流程。Disco Diffusio★ 3,822Dreambooth-Stable-DiffusionDreambooth-Stable-Diffusion 是一个基于 Stable Diffusion 的模型微调工具,通过结合 Dreambooth 和 Tex★ 3,212stability-sdkstability-sdk 是 Stability AI 官方提供的 Python SDK,用于与 stability.ai 的 API 交互,核心是调用 St★ 2,435carefree-creatorcarefree-creator 是一个基于 Stable Diffusion 的 AI 图像生成与编辑工具,主打无限画布上的自由创作。它解决了传统图像生成工具★ 1,936sd-webui-inpaint-anythingsd-webui-inpaint-anything 是一个基于 Stable Diffusion WebUI 的扩展,它将 Segment Anything 的★ 1,295audio-diffusion利用 Hugging Face 的 diffusers 库将扩散模型应用于音乐合成,把图像生成领域的扩散技术迁移到音频,支持生成风格多样的音乐片段。是探索扩散模★ 794DiffusionFastForwardDiffusionFastForward 是一个面向扩散生成模型的开源课程与实验框架,旨在帮助学习者和开发者快速上手扩散模型。项目以 Jupyter Noteb★ 685SkyPaint-AI-DiffusionSkyPaint-AI-Diffusion 是一个基于 Stable Diffusion 优化的中文 AI 绘画模型,旨在解决中文用户使用文本生成图像时提示词理★ 646One-DMOne-DM 是一个基于扩散模型的手写文本生成工具,对应 ECCV 2024 论文《One-Shot Diffusion Mimicker for Handwr★ 566Awesome-Controllable-Diffusion这是一个聚焦扩散模型可控生成的精选资源列表,收录了ControlNet、DreamBooth、IP-Adapter等前沿方法的论文与代码。它系统梳理了从结构控制★ 504CVPR23_LFDMCVPR23_LFDM 是 CVPR 2023 论文《Conditional Image-to-Video Generation with Latent Flo★ 470g-diffuser-botg-diffuser-bot 是一个基于 Python 的 Discord 机器人,为 Stable Diffusion 提供交互界面。它解决了在 Discor★ 282inpaint-anythingInpaint Anything 是一个基于浏览器的图像修复工具,它将 Meta 的 Segment Anything 模型(SAM)与 Stable Diff★ 274tiny-dreamTiny Dream 是一个嵌入式、仅头文件的 Stable Diffusion C++ 实现,旨在将强大的文生图模型压缩到资源受限的设备上运行。它解决了传统 ★ 269StableDiffusion-PyTorchStableDiffusion-PyTorch 是一个用 PyTorch 从零实现 Stable Diffusion 模型的教学型开源项目,涵盖文本编码器、U-★ 255transformer_latent_diffusion这是一个基于Transformer核心的文本到图像潜在扩散模型实现,旨在探索用Transformer替代传统U-Net作为扩散模型主干网络的可能性。项目解决了S★ 230awesome-diffusion这是一个精选的扩散模型(Diffusion Models)资源列表,汇集了相关的 notebooks、工具、软件、教程和资料。它旨在帮助研究人员和开发者快速找到★ 219KandinskyVideoKandinskyVideo 是一个基于潜在扩散模型的多语言文本生成视频的开源项目,由 Kandinsky 团队开发。它解决了从文本描述直接生成连贯视频片段的问★ 185Simple_Prompt_GeneratorSimple_Prompt_Generator 是一个面向 AI 图像生成模型的提示词生成工具,旨在帮助用户快速创建高质量、结构化的文本提示词,适用于 Midj★ 166TokenComposeTokenCompose 是一个基于扩散模型的文本到图像生成方法,核心创新在于引入 token 级别的监督信号,以解决多物体组合生成中常见的问题,如物体遗漏、属★ 137LeanVAELeanVAE 是一个面向视频扩散模型的高效重建 VAE,旨在解决视频生成中 VAE 计算开销大、内存占用高的问题。它通过轻量级架构设计,在保证视频重建质量的同★ 117latent-diffusion-segmentation这是一个基于潜在扩散模型(Latent Diffusion)的开放世界全景分割与掩码修复工具,来自ECCV 2024论文。它解决传统全景分割依赖封闭类别集合、难★ 109SesquiLSRSesquiLSR 是一个面向 Stable Diffusion XL、Flux、Flux2 及 Wan 2.1/Anima/Qwen Image 等模型的任意★ 104easydiffusionEasy Diffusion 是一个基于 Jupyter Notebook 的 Stable Diffusion 高级实现,旨在为图像生成提供一套功能丰富的处理★ 102WordStylistWordStylist 是 ICDAR 2023 论文的官方 PyTorch 实现,专注于手写文本生成。它利用潜在扩散模型(Latent Diffusion M★ 82ComfyUI-ShaderNoiseKSamplerComfyUI-ShaderNoiseKSampler 是一个 ComfyUI 的自定义节点,用于替代默认的 KSampler,将 AI 图像生成从随机探索转变★ 67stable-karlostable-karlo 是一个将 Karlo 文本生成图像模型与 Stable Diffusion v2 的潜在扩散架构结合的开源项目。它解决了 Karlo ★ 63comfyui-dockercomfyui-docker 是一个为 ComfyUI 提供 Docker 镜像的项目。ComfyUI 是一款基于节点/图界面的 Stable Diffusio★ 60Image-AI-Generator-2026Image-AI-Generator-2026 是一款桌面端 AI 图像生成工具,旨在让创作者快速产出高质量的艺术作品、照片级渲染和创意概念。它基于扩散模型和深★ 53binary-latent-diffusionBinary Latent Diffusion 是一个基于 PyTorch 的潜在扩散模型实现,专注于在二值化潜在空间中进行图像生成。它解决了传统扩散模型在连续★ 51