音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

brasiltts 开源

让巴西葡萄牙语屏幕内容开口说话,助力视障用户轻松获取信息。

Brasil TTS 是一个面向巴西葡萄牙语用户的文本转语音(TTS)工具集,主要服务于视力障碍人群,帮助···

★ 70 评分 2019-03-25
Transformer-TTS 开源

用 Transformer 替代 RNN,快速训练语音合成模型

Transformer-TTS 是一个基于 PyTorch 实现的文本转语音(TTS)项目,对应论文《Neural Speech Synt···

★ 694 评分 2019-03-20
NVDA-IBMTTS-Driver 开源

让 NVDA 用上经典 IBMTTS 语音,听感更自然

NVDA-IBMTTS-Driver 是一个为 NVDA 屏幕阅读器开发的 IBMTTS 语音合成驱动插件。IBMTTS 是一款与 E···

★ 78 评分 2019-03-18
ZeroSpeech-TTS-without-T 开源

无需文本标注,直接从语音学习并合成语音,攻克低资源TTS难题。

这是一个基于PyTorch的ZeroSpeech 2019挑战赛实现,旨在解决无文本标注的语音合成(TTS-without-T)···

★ 112 评分 2019-02-15
gmvae_tacotron 开源

用高斯混合潜变量提升语音韵律表现力,生成更自然的合成语音

gmvae_tacotron 是一个基于高斯混合变分自编码器(GM-VAE)与 Tacotron 结合的语音合成实验项目。它···

★ 54 评分 2019-02-09
vae_tacotron2 开源

用VAE隐变量控制语音风格,让TTS更自然有表现力

VAE Tacotron 2 是一个基于变分自编码器(VAE)的语音合成(TTS)模型,作为 GST Tacotron 的替代方···

★ 91 评分 2019-01-26
Tacotron2 开源

从文本直接生成自然语音的经典端到端 TTS 实现

Tacotron2 是一个基于 PyTorch 实现的端到端文本转语音(TTS)系统,源自 NVIDIA 的论文《Natural ···

★ 52 评分 2019-01-23
RealTimeSingingSynthesizer 开源

用代码实时合成歌声,现场编程即兴演唱

RealTimeSingingSynthesizer 是一个基于 Python 的实时歌唱合成器,封装了 sinsy-NG 引擎,支持通过···

★ 60 评分 2018-12-29
harmony 开源

输入旋律,自动生成符合规则的四部和声

harmony 是一个基于 Python 的开源项目,旨在通过动态规划(DP)算法自动生成遵循传统声部进行规则···

★ 54 评分 2018-12-29
genmusic_demo_list 开源

一站式逛遍AI音乐生成Demo,快速体验前沿技术

这是一个自动音乐生成研究领域的演示网站列表,收录了众多相关项目的在线Demo入口。它解决的是研究···

★ 799 评分 2018-12-26
alda-clj 开源

用 Clojure 实时编写并播放音乐,代码即乐谱

alda-clj 是一个基于 Clojure 的实时编程音乐库,它封装了 Alda 音乐编程语言,让开发者可以用 Clo···

★ 70 评分 2018-12-11
blossom 开源

点点画画,即刻生成你的专属旋律

Blossom 是一个基于 JavaScript 的交互式音乐生成器,旨在让用户通过直观的图形界面轻松创作旋律。···

★ 248 评分 2018-12-08
discord-tts-bot 开源

给 Discord 加个语音播报员,文字秒变语音

discord-tts-bot 是一个用 JavaScript 编写的 Discord 文本转语音机器人。它解决了 Discord 用户无···

★ 103 评分 2018-12-03
Awesome-Text-to-Speech 开源

一份清单,带你速览 TTS 最新工具和模型,少走弯路。

Awesome-Text-to-Speech 是一个精心整理的文本转语音(TTS)领域资源列表,汇集了最新的工具、模型···

★ 194 评分 2018-12-03
hum2song 开源

哼一段旋律,自动生成多轨伴奏音乐

Hum2Song 是一个基于神经网络的音乐生成工具,能够将用户哼唱的旋律自动转录并生成多轨复调音乐。它···

★ 160 评分 2018-11-08
waveglow 开源

用流模型快速生成高质量语音波形,让 TTS 更流畅。

WaveGlow 是一个基于流的生成式神经网络,用于语音合成中的声码器环节,能将梅尔频谱图高效转换为高···

★ 205 评分 2018-11-04
infinite_gnossienne 开源

让萨蒂的经典钢琴曲无限流淌,永不停歇。

infinite_gnossienne 是一个用 JavaScript 实现的生成式音乐项目,它基于 Erik Satie 的经典钢琴曲···

★ 103 评分 2018-10-30
tts 开源

一行命令,用 Amazon Polly 把你的文字变成语音。

这是一个基于 Node.js 的极简文本转语音(TTS)命令行工具,核心功能是将用户输入的文本转换为语音···

★ 172 评分 2018-09-24
cnn_vocoder 开源

用CNN快速生成语音波形,比传统声码器更快

cnn_vocoder 是一个基于卷积神经网络(CNN)的快速声码器(vocoder)开源项目,用 Python 实现。声···

★ 78 评分 2018-09-22
mimic-recording-studio 开源

Docker 一键部署,网页录制语音样本,训练 Mimic2 专属 TTS 声音

Mimic Recording Studio 是一个基于 Docker 的语音样本录制工具,专为 Mycroft 的 Mimic2 TTS(文本···

★ 517 评分 2018-09-17
Tacotron-pytorch 开源

用 PyTorch 复现 Tacotron,快速搭建端到端语音合成模型

Tacotron-pytorch 是一个基于 PyTorch 实现的 Tacotron 端到端文本转语音(TTS)模型。Tacotron 是···

★ 110 评分 2018-09-13
Audio-book-generator 开源

把电子书丢进去,自动生成有声书,解放双眼听书

Audio-book-generator 是一个将电子书转换为有声书的 Python 工具。它解决的是用户没时间阅读电子书···

★ 72 评分 2018-09-09
parrots 开源

开箱即用的中英语音识别与多角色合成引擎

parrots 是一个基于 Python 的自动语音识别(ASR)与语音合成(TTS)引擎,专注于中英语音处理。它···

★ 529 评分 2018-08-26
musical-neural-net 开源

用 LSTM 训练 AI 生成钢琴或小提琴音乐,输入 MIDI 即出作品。

musical-neural-net 是一个用 LSTM 循环神经网络训练生成钢琴或小提琴/钢琴合奏音乐的早期开源项目···

★ 567 评分 2018-08-24