FastSpeech2
开源
并行合成高质量语音,速度飞快,效果自然
FastSpeech2 是一个基于 PyTorch 的端到端文本转语音(TTS)实现,源自微软提出的 FastSpeech 2 模···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
FastSpeech2
开源
并行合成高质量语音,速度飞快,效果自然
FastSpeech2 是一个基于 PyTorch 的端到端文本转语音(TTS)实现,源自微软提出的 FastSpeech 2 模···
1SHOT
开源
一个机器人搞定 Discord 音乐、游戏和管理
1SHOT 是一个基于 Discord.js v14 和 ES6 模块构建的多功能 Discord 机器人,集音乐播放、娱乐游戏···
tts-util-app
开源
把文字变成语音,安卓上随时听
TTS Util 是一款开源的 Android 文本转语音工具应用,使用 Kotlin 开发,旨在将任意文本快速合成为···
ParallelWaveGAN
开源
一站式 PyTorch 声码器集合,快速生成高保真语音波形。
ParallelWaveGAN 是一个基于 PyTorch 的非官方实现,集成了多种主流神经声码器,包括 Parallel Wav···
Thorsten-Voice
开源
免费离线德语TTS,告别许可烦恼,即拿即用
Thorsten-Voice 是一个免费、离线可用的高质量德语文本转语音(TTS)语音项目。它旨在解决开发者在···
melgan
开源
用GAN声码器把梅尔频谱快速变成逼真语音
MelGAN 是一个基于 GAN 的语音合成声码器(vocoder)实现,支持多频带(Multi-Band)和全频带(Ful···
melgan
开源
把频谱图变成自然语音,实时合成不卡顿
MelGAN 是一个基于生成对抗网络的声码器(vocoder),用于将梅尔频谱图(mel-spectrogram)转换为高···
ismir2019tutorial
开源
跟着教程用GAN生成音乐,从理论到案例一站学会
这是一个用于ISMIR 2019教程的配套网站,教程主题为“用GAN生成音乐:概述与案例研究”。该项目旨在···
tacotron2
开源
多说话人+情感语音合成,一键生成个性化语音
Tacotron2 是一个基于 Tacotron 2 和 Waveglow 的多说话人、情感语音合成(TTS)开源项目。它解决了···
esp32-flite
开源
在ESP32上离线运行TTS,让嵌入式设备开口说话
esp32-flite 是一个将 Flite 语音合成引擎移植到 ESP32 微控制器上的开源项目。它解决了在资源受限···
ronor
开源
在终端里控制你的 Sonos 音箱,还能用文字转语音播报
ronor 是一个用 Rust 编写的 Sonos 智能音箱控制工具,提供 API 和命令行界面。它解决了 Sonos 官方···
TellTime
开源
用英式腔调,动嘴就能知道几点
TellTime 是一款 iOS 应用,用英式英语播报当前时间,比如“It's half past ten”。它基于 SwiftUI···
JJazzLab
开源
输入和弦,一键生成专业级伴奏,让练琴和创作不再孤单。
JJazzLab 是一款开源的自动伴奏生成应用,专为音乐人、练习者和即兴演奏者设计。它解决了在没有真实···
c-rnn-gan.pytorch
开源
用对抗网络生成连贯钢琴曲,上手即用
C-RNN-GAN 是一个用 PyTorch 实现的音乐生成模型,基于连续循环神经网络和生成对抗网络的结合。它解···
Multi-Tacotron-Voice-Cloning
开源
上传几段声音,克隆俄英双语说话人
这是一个基于多语种Tacotron的语音克隆项目,支持俄语和英语两种语言的音素级语音合成与克隆。它解···
MelNet
开源
在频域上自回归生成音频,让AI学会谱曲和说话
MelNet 是一个基于 PyTorch 的音频生成模型实现,源自论文《MelNet: A Generative Model for Audio···
Multilingual_Text_to_Speech
开源
一个模型搞定多语言混合语音合成,还能克隆声音
这是一个基于 Tacotron 2 的多语言文本转语音(TTS)实现,专注于支持多语言实验,包括参数共享、语···
hands-on-music-generation-with-magen···
开源
跟着书撸代码,用Magenta快速上手AI音乐生成
这是《Hands-On Music Generation with Magenta》一书的官方代码仓库与配套资源库。该书面向希望利···
wavegan-pytorch
开源
用 PyTorch 训练 WaveGAN,生成原始音频波形
WaveGAN 的 PyTorch 非官方实现,用于生成原始音频波形。该项目解决了从零训练生成对抗网络(GAN)···
Hassio-Addons
开源
给 Home Assistant 装上音频插件,一键搞定音乐播放和流处理
Hassio-Addons 是一个为 Home Assistant Supervisor 提供第三方附加组件的仓库,主要面向音频和音乐···
tacotron2-mandarin
开源
用 TensorFlow 训练中文语音合成模型,快速生成普通话语音。
tacotron2-mandarin 是一个基于 TensorFlow 的 Tacotron-2 模型中文语音合成实现,旨在解决中文文本···
Tacotron2-PyTorch
开源
用PyTorch快速训练Tacotron 2,支持缩减因子加速合成
这是一个基于PyTorch实现的Tacotron 2文本转语音(TTS)模型,旨在提供比原始实现更快的训练速度和···
Real-Time-Voice-Cloning
开源
5秒克隆声音,实时生成任意语音
Real-Time-Voice-Cloning 是一个基于深度学习的实时语音克隆工具,能在5秒内克隆任意说话人的声音,···
tts
开源
一个网页工具,快速试听多个TTS服务的语音效果
这是一个极简的文本转语音(TTS)演示工具,基于HTML5和原生JavaScript构建,后端使用PHP。它聚合了···