音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

FastSpeech2 开源

并行合成高质量语音,速度飞快,效果自然

FastSpeech2 是一个基于 PyTorch 的端到端文本转语音(TTS)实现,源自微软提出的 FastSpeech 2 模···

★ 237 评分 2019-11-16
1SHOT 开源

一个机器人搞定 Discord 音乐、游戏和管理

1SHOT 是一个基于 Discord.js v14 和 ES6 模块构建的多功能 Discord 机器人,集音乐播放、娱乐游戏···

★ 82 评分 2019-11-09
tts-util-app 开源

把文字变成语音,安卓上随时听

TTS Util 是一款开源的 Android 文本转语音工具应用,使用 Kotlin 开发,旨在将任意文本快速合成为···

★ 195 评分 2019-11-07
ParallelWaveGAN 开源

一站式 PyTorch 声码器集合,快速生成高保真语音波形。

ParallelWaveGAN 是一个基于 PyTorch 的非官方实现,集成了多种主流神经声码器,包括 Parallel Wav···

★ 1645 评分 2019-10-29
Thorsten-Voice 开源

免费离线德语TTS,告别许可烦恼,即拿即用

Thorsten-Voice 是一个免费、离线可用的高质量德语文本转语音(TTS)语音项目。它旨在解决开发者在···

★ 732 评分 2019-10-29
melgan 开源

用GAN声码器把梅尔频谱快速变成逼真语音

MelGAN 是一个基于 GAN 的语音合成声码器(vocoder)实现,支持多频带(Multi-Band)和全频带(Ful···

★ 63 评分 2019-10-25
melgan 开源

把频谱图变成自然语音,实时合成不卡顿

MelGAN 是一个基于生成对抗网络的声码器(vocoder),用于将梅尔频谱图(mel-spectrogram)转换为高···

★ 651 评分 2019-10-17
ismir2019tutorial 开源

跟着教程用GAN生成音乐,从理论到案例一站学会

这是一个用于ISMIR 2019教程的配套网站,教程主题为“用GAN生成音乐:概述与案例研究”。该项目旨在···

★ 84 评分 2019-09-30
tacotron2 开源

多说话人+情感语音合成,一键生成个性化语音

Tacotron2 是一个基于 Tacotron 2 和 Waveglow 的多说话人、情感语音合成(TTS)开源项目。它解决了···

★ 128 评分 2019-09-23
esp32-flite 开源

在ESP32上离线运行TTS,让嵌入式设备开口说话

esp32-flite 是一个将 Flite 语音合成引擎移植到 ESP32 微控制器上的开源项目。它解决了在资源受限···

★ 79 评分 2019-09-22
ronor 开源

在终端里控制你的 Sonos 音箱,还能用文字转语音播报

ronor 是一个用 Rust 编写的 Sonos 智能音箱控制工具,提供 API 和命令行界面。它解决了 Sonos 官方···

★ 228 评分 2019-09-17
TellTime 开源

用英式腔调,动嘴就能知道几点

TellTime 是一款 iOS 应用,用英式英语播报当前时间,比如“It's half past ten”。它基于 SwiftUI···

★ 68 评分 2019-09-14
JJazzLab 开源

输入和弦,一键生成专业级伴奏,让练琴和创作不再孤单。

JJazzLab 是一款开源的自动伴奏生成应用,专为音乐人、练习者和即兴演奏者设计。它解决了在没有真实···

★ 591 评分 2019-09-01
c-rnn-gan.pytorch 开源

用对抗网络生成连贯钢琴曲,上手即用

C-RNN-GAN 是一个用 PyTorch 实现的音乐生成模型,基于连续循环神经网络和生成对抗网络的结合。它解···

★ 67 评分 2019-09-01
Multi-Tacotron-Voice-Cloning 开源

上传几段声音,克隆俄英双语说话人

这是一个基于多语种Tacotron的语音克隆项目,支持俄语和英语两种语言的音素级语音合成与克隆。它解···

★ 396 评分 2019-08-26
MelNet 开源

在频域上自回归生成音频,让AI学会谱曲和说话

MelNet 是一个基于 PyTorch 的音频生成模型实现,源自论文《MelNet: A Generative Model for Audio···

★ 208 评分 2019-08-17
Multilingual_Text_to_Speech 开源

一个模型搞定多语言混合语音合成,还能克隆声音

这是一个基于 Tacotron 2 的多语言文本转语音(TTS)实现,专注于支持多语言实验,包括参数共享、语···

★ 844 评分 2019-08-06
hands-on-music-generation-with-magen··· 开源

跟着书撸代码,用Magenta快速上手AI音乐生成

这是《Hands-On Music Generation with Magenta》一书的官方代码仓库与配套资源库。该书面向希望利···

★ 156 评分 2019-07-16
wavegan-pytorch 开源

用 PyTorch 训练 WaveGAN,生成原始音频波形

WaveGAN 的 PyTorch 非官方实现,用于生成原始音频波形。该项目解决了从零训练生成对抗网络(GAN)···

★ 173 评分 2019-06-11
Hassio-Addons 开源

给 Home Assistant 装上音频插件,一键搞定音乐播放和流处理

Hassio-Addons 是一个为 Home Assistant Supervisor 提供第三方附加组件的仓库,主要面向音频和音乐···

★ 324 评分 2019-06-09
tacotron2-mandarin 开源

用 TensorFlow 训练中文语音合成模型,快速生成普通话语音。

tacotron2-mandarin 是一个基于 TensorFlow 的 Tacotron-2 模型中文语音合成实现,旨在解决中文文本···

★ 132 评分 2019-06-04
Tacotron2-PyTorch 开源

用PyTorch快速训练Tacotron 2,支持缩减因子加速合成

这是一个基于PyTorch实现的Tacotron 2文本转语音(TTS)模型,旨在提供比原始实现更快的训练速度和···

★ 148 评分 2019-06-02
Real-Time-Voice-Cloning 开源

5秒克隆声音,实时生成任意语音

Real-Time-Voice-Cloning 是一个基于深度学习的实时语音克隆工具,能在5秒内克隆任意说话人的声音,···

★ 60153 评分 2019-05-26
tts 开源

一个网页工具,快速试听多个TTS服务的语音效果

这是一个极简的文本转语音(TTS)演示工具,基于HTML5和原生JavaScript构建,后端使用PHP。它聚合了···

★ 113 评分 2019-05-18