DF-GAN 是图像领域的开源项目,由 tobran 开发,2020 年首次发布。
它收录于图像分类,该分类目前共有 837 个项目,GitHub 星标数为 326。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-14。完全免费,需自行部署使用。
它主要面向的使用场景是:学术研究:作为文本生成图像的基线对比方法。同类可对比的替代方案包括 AttnGAN、StackGAN、DALL-E。

用简单结构高效实现文本到图像生成,性能媲美复杂模型。
DF-GAN是一个用于文本到图像合成的生成对抗网络模型,发表于CVPR 2022 oral。它针对现有文本生成图像方法中生成器结构复杂、训练不稳定且依赖额外辅助网络的问题,提出了一个简单而有效的基线。其核心是深度融合模块(DF block),通过将文本嵌入在多个尺度上以通道级方式与图像特征深度融合,并利用目标感知判别器(Target-Aware Discriminator)强化文本与图像的语义对齐。DF-GAN在CUB鸟类和COCO数据集上取得了当时最优的FID和IS分数,同时保持了较少的参数和更快的训练速度。该模型为文本到图像生成领域提供了一个简洁、高效且易于复现的基准方法,适合作为后续研究的起点。
AttnGAN、StackGAN、DALL-E
DF-GAN 是图像领域的开源项目,由 tobran 开发,2020 年首次发布。
它收录于图像分类,该分类目前共有 837 个项目,GitHub 星标数为 326。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-14。完全免费,需自行部署使用。
它主要面向的使用场景是:学术研究:作为文本生成图像的基线对比方法。同类可对比的替代方案包括 AttnGAN、StackGAN、DALL-E。
上一篇:FIBO
satori
开源
网页代码一键变高清图,放大不糊,不用截图
Enlightened library to convert HTML and CSS to SVG
C2GAN
开源
用关键点精准控制图像生成,让AI画出你想要的结构
[ACM MM 2019 Oral] Cycle In Cycle Generative Adversarial Networks for Keypoint-Guide···
stable-diffusion-webui
开源
打开网页说想法,配图素材几秒到手
Stable Diffusion web UI
ComfyUI
开源
像搭积木一样连节点,生图流程自己搭
The most powerful and modular diffusion model GUI, api and backend with a graph/node···