fastspeech2

本站收录 14 个带「fastspeech2」标签的 AI 开源项目

AmphionAmphion 是一个面向音频、音乐和语音生成的开源工具包,旨在支持可复现研究,并帮助初级研究者和工程师快速入门。它集成了多种主流模型与算法,涵盖文本到语音(T★ 10,305TensorFlowTTSTensorFlowTTS 是一个基于 TensorFlow 2 的实时语音合成工具包,旨在提供最先进的语音合成能力。它解决了从文本到语音(TTS)的完整流程问★ 3,995ParakeetParakeet 是百度 PaddlePaddle 生态下的并行语音合成工具包,旨在提供从文本到语音的完整训练与推理流程。它集成了多种主流 TTS 模型,包括自★ 628mandarin-ttsmandarin-tts 是一个基于 PyTorch 实现的中文普通话语音合成(TTS)开源项目。它采用 FastSpeech 2 作为声学模型,WaveGlo★ 477Comprehensive-Transformer-TTS这是一个基于非自回归Transformer的文本转语音(TTS)项目,集成了多种SOTA Transformer架构,并支持有监督和无监督两种时长建模方式。它解★ 327Chinese-FastSpeech2Chinese-FastSpeech2 是一个基于 FastSpeech2 的中文语音合成(TTS)开源项目。它针对中文发音特点,在标贝数据上继续训练,并引入了★ 275FastSpeech2FastSpeech2 是一个基于 PyTorch 的端到端文本转语音(TTS)实现,源自微软提出的 FastSpeech 2 模型。它解决了传统自回归 TTS★ 237TensorVoxTensorVox 是一个用 C++ 编写的桌面端神经语音合成应用,专注于将文本实时转换为自然语音。它解决了传统 TTS 工具依赖云端、延迟高、集成复杂的问题,★ 214AdaSpeechAdaSpeech 是一个基于 PyTorch 的自适应文本转语音(TTS)项目,旨在为自定义声音提供高质量的语音合成能力。它针对传统 TTS 系统在适应新说话★ 163Comprehensive-E2E-TTS这是一个基于 PyTorch 的非自回归端到端文本转语音(TTS)项目,直接将文本转换为语音波形,无需中间声学特征。它集成了多种前沿的无监督时长建模方法,支持 ★ 147FastSpeech2FastSpeech2 是一个基于 PyTorch 的多说话人端到端文本转语音(TTS)开源实现,源自微软提出的 FastSpeech2 模型。它解决了传统自回★ 99AdaSpeechAdaSpeech 是微软提出的自适应文本转语音(TTS)模型的非官方实现,旨在通过少量参考音频实现定制化音色克隆。它基于 FastSpeech 2 架构,引入★ 98LightSpeechLightSpeech 是一个基于神经架构搜索(NAS)的轻量级快速文本转语音(TTS)项目。它旨在解决传统 TTS 模型参数量大、推理速度慢的问题,通过自动搜★ 96FastSpeech2FastSpeech2 是一个基于 PyTorch 实现的端到端文本转语音(TTS)模型,源自微软提出的非自回归语音合成架构。它解决了传统自回归 TTS(如 T★ 52