image-synthesis
本站收录 23 个带「image-synthesis」标签的 AI 开源项目
mmagicOpenMMLab 推出的多模态生成智能创作工具箱,提供开箱即用的 AIGC 能力、易用 API 与丰富模型库,涵盖文生图、图像/视频修复与增强等任务,是搭建生★ 7,470
Awesome-Text-to-ImageAwesome-Text-to-Image 是一个聚焦文本到图像生成/合成领域的精选资源列表,旨在系统梳理该方向的研究进展、关键技术和开源工具。它解决了研究人员★ 2,447
HR-VITONHR-VITON 是一个基于 PyTorch 的高分辨率虚拟试穿(Virtual Try-On)开源项目,对应 ECCV 2022 论文《High-Resolu★ 916
APDrawingGANAPDrawingGAN 是一个基于生成对抗网络(GAN)的开源项目,用于将人脸照片自动转换为艺术风格的人物肖像画(如素描、线条画)。该项目由 CVPR 201★ 811
focal-frequency-lossFocal Frequency Loss 是一个基于频域分析的图像重建与合成损失函数库,来自 ICCV 2021 论文。它解决的是生成模型(如 GAN、自编码器★ 715
cycle-diffusionCycle-Diffusion 是一个基于扩散模型的图像编辑工具,核心思想是在潜在空间中实现源图像与目标图像之间的循环一致性映射,从而支持无需额外训练的图像到图★ 661
StyleSwinStyleSwin 是一个基于 Transformer 的高分辨率图像生成模型,发表于 CVPR 2022。它针对传统 GAN 在生成高分辨率图像时依赖卷积结构★ 543
Awesome-Controllable-Diffusion这是一个聚焦扩散模型可控生成的精选资源列表,收录了ControlNet、DreamBooth、IP-Adapter等前沿方法的论文与代码。它系统梳理了从结构控制★ 504
PITIPITI是一个基于预训练的图像到图像翻译框架,核心思想是“预训练即一切”,旨在解决传统图像翻译模型需要大量配对数据、训练成本高且泛化能力弱的问题。它利用大规模预★ 504
ArtGANArtGAN 是一个基于生成对抗网络(GAN)的深度学习项目,专注于条件图像合成,特别是艺术画作的生成。它通过改进 GAN 的结构和训练策略,利用 WikiAr★ 432
MagicBrushMagicBrush 是 NeurIPS 2023 收录的一个用于指令引导图像编辑的手工标注数据集。它解决了现有图像编辑数据集依赖自动生成、指令与编辑结果不匹配★ 413
CoCosNet-v2CoCosNet-v2 是一个基于深度学习的图像翻译项目,专注于全分辨率对应关系学习。它解决的是图像到图像翻译中,当输入图像与参考图像存在大形变或视角差异时,如★ 346
DeceiveDDeceiveD 是 NeurIPS 2021 收录的少样本 GAN 训练方法,核心解决真实数据不足时 GAN 训练不稳定、易过拟合的问题。它提出自适应伪增强(★ 234
arbitrary-text-to-image-papers这是一个持续更新的论文列表,系统梳理了任意文本到图像生成领域的学术资源。项目按技术路线分类整理,涵盖基于GAN、场景图、对话交互等不同范式的论文,并为每篇论文附★ 210
blur-diffusionblur-diffusion 是论文《Progressive Deblurring of Diffusion Models for Coarse-to-Fine★ 159
unified-generative-zoounified-generative-zoo 是一个基于 PyTorch 的统一生成模型代码库,收录了扩散模型、GAN、基于分数的生成模型等主流方法,并支持 3★ 123
FridoFrido 是一个基于特征金字塔扩散模型的图像生成研究项目,源自论文《Frido: Feature Pyramid Diffusion for Complex ★ 114
semantic-object-accuracy-for-generative-text-to-image-synthesis这是一个用于生成式文本到图像合成任务的语义对象准确率评估工具,对应TPAMI 2020论文。它解决的是传统评估指标(如IS、FID)无法有效衡量生成图像中语义对★ 106
text-to-image这是一个基于生成对抗网络(GAN)的文本到图像合成项目,旨在将自然语言描述转换为对应的视觉图像。项目实现了条件GAN(conditional GAN)和条件Wa★ 78
DCGAN-TensorflowDCGAN-Tensorflow 是一个基于 TensorFlow 实现的深度卷积生成对抗网络(DCGAN)开源项目,主要用于图像生成任务。它解决了传统 GAN★ 71
Image-Text-Papers这是一个精选图像描述与文本生成图像相关论文的列表,旨在为多模态生成领域的研究者提供系统性的文献索引。项目按研究方向分类整理,涵盖图像描述、文本到图像合成、多模态★ 69
QMUPDQMUPD 是一个基于生成对抗网络(GAN)的开源项目,用于从非成对训练数据中生成高质量的人像线条画。该项目源自 TPAMI 论文,核心解决传统线条画生成依赖成★ 63
LSRNALSRNA 是一个基于扩散模型的潜在空间超分辨率方法,旨在解决扩散模型生成高分辨率图像时计算成本高、细节不足的问题。它通过在潜在空间中进行超分辨率处理,而非在像★ 51