fastspeech

本站收录 13 个带「fastspeech」标签的 AI 开源项目

TensorFlowTTSTensorFlowTTS 是一个基于 TensorFlow 2 的实时语音合成工具包,旨在提供最先进的语音合成能力。它解决了从文本到语音(TTS)的完整流程问★ 3,995DiffGAN-TTSDiffGAN-TTS 是一个基于 PyTorch 的文本转语音(TTS)实现,核心思想是结合扩散模型(Diffusion)和生成对抗网络(GAN),在保证高保★ 349PortaSpeechPortaSpeech 是一个基于 PyTorch 的非自回归文本转语音(TTS)实现,源自论文《PortaSpeech: Portable and High-★ 341Comprehensive-Transformer-TTS这是一个基于非自回归Transformer的文本转语音(TTS)项目,集成了多种SOTA Transformer架构,并支持有监督和无监督两种时长建模方式。它解★ 327FCH-TTSFCH-TTS 是一个快速文本转语音(TTS)模型,基于 Python 实现,支持英语、中文、日语、韩语、俄语和藏语六种语言。它旨在解决传统 TTS 模型推理速★ 281DiffSingerDiffSinger 是一个基于 PyTorch 的开源歌声合成(Singing Voice Synthesis)项目,核心思想是将浅层扩散机制(Shallow★ 247FastSpeech2FastSpeech2 是一个基于 PyTorch 的端到端文本转语音(TTS)实现,源自微软提出的 FastSpeech 2 模型。它解决了传统自回归 TTS★ 237StyleSpeechStyleSpeech 是 Meta-StyleSpeech 的 PyTorch 非官方实现,旨在解决多说话人自适应文本转语音(TTS)中需要大量参考音频的问题★ 198Parallel-Tacotron2Parallel-Tacotron2 是 Google Parallel Tacotron 2 的 PyTorch 非官方实现,旨在解决传统自回归 TTS 模型★ 191AdaSpeechAdaSpeech 是一个基于 PyTorch 的自适应文本转语音(TTS)项目,旨在为自定义声音提供高质量的语音合成能力。它针对传统 TTS 系统在适应新说话★ 163LightSpeechLightSpeech 是一个基于神经架构搜索(NAS)的轻量级快速文本转语音(TTS)项目。它旨在解决传统 TTS 模型参数量大、推理速度慢的问题,通过自动搜★ 96FastPitchFormantFastPitchFormant 是 NCSOFT 提出的 FastPitchFormant 模型的 PyTorch 非官方实现,该模型基于源-滤波器(sour★ 74FastSpeech2FastSpeech2 是一个基于 PyTorch 实现的端到端文本转语音(TTS)模型,源自微软提出的非自回归语音合成架构。它解决了传统自回归 TTS(如 T★ 52