CycleGAN-VC2 是音频音乐领域的开源项目,由 jackaduma 开发,2020 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 573。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-23。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:个性化语音合成(如虚拟主播音色定制)。同类可对比的替代方案包括 StarGAN-VC、AutoVC、SVC (SoftVC VITS)。

无需平行语料,一键实现音色转换
CycleGAN-VC2 是一个基于 CycleGAN 的语音转换(Voice Conversion)开源项目,旨在实现无需平行语料的音色转换。它解决了传统语音转换需要成对训练数据的问题,利用循环一致性损失(cycle consistency loss)和对抗训练,将源说话人的语音转换为目标说话人的音色,同时保留语言内容。项目核心能力包括:支持非平行语料训练、改进的生成器架构(使用 gated CNN 和残差连接)提升音频质量、以及提供完整的训练和推理流程。它特别适用于低资源场景下的语音转换,如个性化语音合成、娱乐应用中的声音模仿等。项目代码基于 PyTorch 实现,包含数据预处理、模型训练和转换脚本,方便研究者复现和二次开发。
StarGAN-VC、AutoVC、SVC (SoftVC VITS)
CycleGAN-VC2 是音频音乐领域的开源项目,由 jackaduma 开发,2020 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 573。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-23。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:个性化语音合成(如虚拟主播音色定制)。同类可对比的替代方案包括 StarGAN-VC、AutoVC、SVC (SoftVC VITS)。
上一篇:YouTranslate
下一篇:rtvc
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···