gan

本站收录 117 个带「gan」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

AI-For-Beginners微软出品的AI入门教程,专为初学者设计,用12周24课时的结构系统讲解人工智能核心知识。课程覆盖神经网络基础、计算机视觉(CNN)、自然语言处理(RNN)、生成★ 69,261pytorch-CycleGAN-and-pix2pixPyTorch 实现的经典图像到图像转换框架,包含 pix2pix 与 CycleGAN 两大模型,支持风格迁移、图像修复、超分辨率等任务,是学习与复现 GAN★ 25,254leedl-tutorial《李宏毅深度学习教程》是Datawhale社区维护的开源教材,源自台湾大学李宏毅老师的深度学习课程。该项目将课程内容整理为Jupyter Notebook格式,★ 16,787CycleGAN经典无监督图像风格迁移框架,无需成对数据即可实现照片转绘画、马变斑马等趣味效果,广泛应用于风格迁移与图像翻译领域,是计算机视觉领域教科书级的开源项目。★ 12,876pix2pix基于条件对抗网络的开创性图像到图像翻译模型,只需成对数据即可实现线稿上色、语义图转照片、街景转换等任务,是 pix2pix 家族的奠基之作,对后续研究影响深远。★ 10,662PaddleGAN飞桨 PaddlePaddle 官方 GAN 库,汇集人脸动画驱动、Wav2Lip 口型合成、图片修复、照片转卡通、风格迁移、GPEN 人脸增强等众多实用应用,★ 8,045TensorLayerTensorLayer 是一个面向科学家和工程师的深度学习与强化学习库,基于 Python 构建。它旨在解决深度学习研究和工程应用中模型搭建复杂、调试困难、部署★ 7,382StyleTTS2StyleTTS 2 通过风格扩散与对抗训练,结合大型语音语言模型,实现了接近人类水平的文本转语音。合成语音的自然度与韵律表现力出众,即使无参考语音也能生成高质★ 6,361SDVSDV(Synthetic Data Vault)是一个用于表格数据合成生成的Python库,旨在解决真实数据隐私保护、数据稀缺和测试数据获取难的问题。它提供了★ 3,567dalle-playgrounddalle-playground 是一个基于 Web 的文本生成图像交互界面,最初支持 DALL-E Mini,现已转向 Stable Diffusion。它解★ 2,738synthetic-data-generatorsynthetic-data-generator(SDG)是一个专门用于生成高质量结构化表格数据的开源框架。它解决的核心问题是真实数据获取难、隐私保护要求高、以★ 2,439ailia-modelsailia-models 是一个汇集了预训练、前沿 AI 模型的集合,专为 ailia SDK 设计。它解决了 AI 模型从研究到部署之间的鸿沟,提供了统一、易★ 2,393hifi-ganHiFi-GAN 是一个基于生成对抗网络的高保真语音合成声码器,由韩国首尔大学团队开发。它解决了传统神经声码器(如 WaveNet)推理速度慢、难以实时部署的问★ 2,372Anime2SketchAnime2Sketch 是一个专门从动漫/插画图像中提取线稿的开源工具。它基于生成对抗网络(GAN)和深度学习技术,能够自动将彩色动漫图片转换为干净、清晰的线★ 2,130TensorFlow-TutorialsTensorFlow-Tutorials 是一个面向初学者的 TensorFlow 教程代码库,提供从基础到应用的逐步练习源码。项目覆盖了深度学习核心领域,包括★ 2,122museganMuseGAN 是一个基于生成对抗网络的音乐生成模型,可生成多轨、多乐器协同的复调音乐,支持钢琴曲与完整多轨作品的创作。为 AI 音乐生成研究提供了经典的基线方★ 2,045art-DCGANart-DCGAN 是一个基于 DCGAN 的生成艺术项目,专注于用深度学习生成艺术图像。它解决了传统 DCGAN 在艺术创作中训练不稳定、生成质量不高的问题,★ 2,005CoreML-ModelsCoreML-Models 是一个将多种主流深度学习模型转换为 Apple Core ML 格式的模型仓库(Model Zoo)。它解决了 iOS/macOS ★ 1,878ganspaceganspace 是一个用于发现 GAN 模型中可解释控制方向的开源工具,源自 NeurIPS 2020 论文。它解决了生成对抗网络(GAN)内部潜在空间难以理★ 1,795fg-data-syntheticfg-data-synthetic 是一个专注于表格数据和时间序列数据合成的开源工具库。它利用生成对抗网络(GAN)等深度学习技术,解决真实数据获取成本高、隐私★ 1,659clean-fidclean-fid 是一个用于计算 FID(Frechet Inception Distance)分数的 PyTorch 工具库,由 CVPR 2022 论文提★ 1,170CVPR2022-DaGANDaGAN 是 CVPR 2022 收录的论文《Depth-Aware Generative Adversarial Network for Talking H★ 997CartoonGan-tensorflowCartoonGan-tensorflow 是 CVPR 2018 论文 CartoonGAN 的 TensorFlow 2.0 Alpha 实现,用于将真实照★ 938FireRedTTSFireRedTTS 是一个基于大语言模型(LLM)的开源语音合成(TTS)系统,旨在提供高质量、自然且可控的文本到语音生成能力。它结合了语言模型、扩散模型、流★ 926APDrawingGANAPDrawingGAN 是一个基于生成对抗网络(GAN)的开源项目,用于将人脸照片自动转换为艺术风格的人物肖像画(如素描、线条画)。该项目由 CVPR 201★ 811anycost-ganAnycost GANs 是 CVPR 2021 收录的交互式图像合成与编辑框架,由 MIT 等机构提出。它解决的是 GAN 模型在推理时计算开销大、难以在普通★ 779text2arttext2art 是一个基于深度学习的文本生成艺术工具,旨在将文字描述直接转化为多种风格的艺术图像,包括像素画、油画、素描等。它利用 GAN 等生成模型,在 G★ 771music-generation-with-DL这是一个关于使用深度学习进行音乐生成的资源列表,汇集了论文、代码、数据集和工具,旨在帮助研究者和开发者快速了解该领域的研究进展和技术路线。项目按生成方法(如符号★ 729focal-frequency-lossFocal Frequency Loss 是一个基于频域分析的图像重建与合成损失函数库,来自 ICCV 2021 论文。它解决的是生成模型(如 GAN、自编码器★ 715SEANSEAN 是 CVPR 2020 Oral 论文的官方实现,提出语义区域自适应归一化(Semantic Region-Adaptive Normalizatio★ 657HiDTHiDT 是 CVPR 2020 Oral 论文《High-Resolution Daytime Translation Without Domain Labe★ 652melganMelGAN 是一个基于生成对抗网络的声码器(vocoder),用于将梅尔频谱图(mel-spectrogram)转换为高质量语音波形。它解决了传统声码器(如 ★ 651Few-Shot-Patch-Based-Training这是一个基于少量样本补丁训练的交互式视频风格化工具,源自SIGGRAPH 2020论文。它解决的是传统风格迁移需要大量训练数据且难以保持视频时序一致性的问题。核★ 627text-to-image这是一个基于生成对抗网络(GAN)的文本生成图像项目,由知名研究者Scott Reed等人开发,是文本到图像合成领域的早期经典实现。项目解决了从自然语言描述生成★ 599DigiHumanDigiHuman 是一个基于 C# 的 3D 角色自动动画框架,利用姿态估计和地标生成技术,将单目摄像头或视频中的人体动作实时映射到 3D 模型上。它解决了传★ 588CycleGAN-VC2CycleGAN-VC2 是一个基于 CycleGAN 的语音转换(Voice Conversion)开源项目,旨在实现无需平行语料的音色转换。它解决了传统语音★ 572T2FT2F是一个基于深度学习的文本到人脸生成项目,旨在根据自然语言描述直接生成对应的人脸图像。它利用生成对抗网络(GAN)和渐进式增长技术,将文本编码与图像生成结合★ 545BlendGANBlendGAN 是一个基于 PyTorch 的官方实现,来自 NeurIPS 2021 论文。它解决的是人脸风格化生成中风格控制不灵活的问题,核心创新在于提出★ 497ConSinGANConSinGAN 是单图像生成对抗网络(GAN)的 PyTorch 实现,源自论文《Improved Techniques for Training Sing★ 442Text2VideoText2Video 是一个基于 ICASSP 2022 论文的开源项目,实现文本驱动的说话人视频合成。它通过音素字典将输入文本转换为语音,并驱动人物头像生成与★ 438inpainting_gmcnn这是一个基于生成式多列卷积神经网络的图像修复工具,源自NeurIPS 2018论文。它解决的是图像中缺失或损坏区域的智能填充问题,核心能力是利用多列结构捕捉不同★ 435Anime-Face-DatasetAnime-Face-Dataset 是一个专注于动漫人脸图像的高质量数据集项目,旨在为生成对抗网络(GAN)等图像生成模型提供干净、统一格式的训练数据。项目解★ 434ArtGANArtGAN 是一个基于生成对抗网络(GAN)的深度学习项目,专注于条件图像合成,特别是艺术画作的生成。它通过改进 GAN 的结构和训练策略,利用 WikiAr★ 432unetganUNetGAN 是 CVPR 2020 论文《A U-Net Based Discriminator for Generative Adversarial Ne★ 402SwapNetSwapNet 是一个基于深度学习的虚拟试衣开源项目,实现了 Raj 等人 2018 年提出的 SwapNet 算法,并提供了 PyTorch 复现版本,同时支★ 389Deep-Exemplar-based-Video-Colorization这是一个基于深度学习的视频上色工具,来自CVPR 2019论文。它利用参考图像(示例图)为灰度视频自动添加自然色彩,解决传统视频上色中颜色不一致、需要人工干预的★ 370DiffGAN-TTSDiffGAN-TTS 是一个基于 PyTorch 的文本转语音(TTS)实现,核心思想是结合扩散模型(Diffusion)和生成对抗网络(GAN),在保证高保★ 349OASISOASIS是ICLR 2021论文的官方实现,提出了一种仅需对抗监督即可完成语义图像合成的新方法。传统方法依赖复杂的感知损失或特征匹配损失来训练生成器,而OAS★ 339Seq2seq-Chatbot-for-Keras这是一个基于Keras实现的seq2seq聊天机器人项目,采用生成式对话模型,通过编码器-解码器架构学习对话模式。项目解决了传统检索式聊天机器人回复僵硬、缺乏上★ 330improved-video-ganImproved-Video-GAN 是一个基于生成对抗网络(GAN)的视频生成开源项目,源自论文《Improving Video Generation for★ 328