neural-tts

本站收录 14 个带「neural-tts」标签的 AI 开源项目

DiffGAN-TTSDiffGAN-TTS 是一个基于 PyTorch 的文本转语音(TTS)实现,核心思想是结合扩散模型(Diffusion)和生成对抗网络(GAN),在保证高保★ 349PortaSpeechPortaSpeech 是一个基于 PyTorch 的非自回归文本转语音(TTS)实现,源自论文《PortaSpeech: Portable and High-★ 341Comprehensive-Transformer-TTS这是一个基于非自回归Transformer的文本转语音(TTS)项目,集成了多种SOTA Transformer架构,并支持有监督和无监督两种时长建模方式。它解★ 327StyleSpeechStyleSpeech 是 Meta-StyleSpeech 和 StyleSpeech 论文的官方实现,专注于语音合成(TTS)中的风格控制。它解决的核心问题★ 254DiffSingerDiffSinger 是一个基于 PyTorch 的开源歌声合成(Singing Voice Synthesis)项目,核心思想是将浅层扩散机制(Shallow★ 247StyleSpeechStyleSpeech 是 Meta-StyleSpeech 的 PyTorch 非官方实现,旨在解决多说话人自适应文本转语音(TTS)中需要大量参考音频的问题★ 198Cross-Speaker-Emotion-Transfer这是一个基于PyTorch实现的跨说话人情感迁移语音合成项目,源自字节跳动的研究成果。它解决的核心问题是:在文本到语音(TTS)合成中,如何让一个说话人的声音表★ 193Parallel-Tacotron2Parallel-Tacotron2 是 Google Parallel Tacotron 2 的 PyTorch 非官方实现,旨在解决传统自回归 TTS 模型★ 191Comprehensive-E2E-TTS这是一个基于 PyTorch 的非自回归端到端文本转语音(TTS)项目,直接将文本转换为语音波形,无需中间声学特征。它集成了多种前沿的无监督时长建模方法,支持 ★ 147sonatasonata 是一个用 Rust 编写的跨平台神经 TTS(文本转语音)推理引擎,专注于高效运行神经网络语音合成模型。它解决了传统 TTS 引擎依赖重型框架、部★ 75FastPitchFormantFastPitchFormant 是 NCSOFT 提出的 FastPitchFormant 模型的 PyTorch 非官方实现,该模型基于源-滤波器(sour★ 74VAENAR-TTSVAENAR-TTS 是一个基于 PyTorch 的非自回归文本转语音(TTS)合成实现,核心思路是结合变分自编码器(VAE)与非自回归生成框架,旨在解决传统自★ 74WaveGrad2WaveGrad2 是谷歌大脑团队提出的 WaveGrad 2 模型的非官方 PyTorch 实现,专注于文本到语音(TTS)合成。它采用非自回归架构,通过迭代★ 68Daft-ExprtDaft-Exprt 是一个基于 PyTorch 的非自回归语音合成模型,专注于跨说话人的韵律迁移,旨在解决 expressive TTS 中韵律风格难以从源说★ 55