brasiltts
开源
让巴西葡萄牙语屏幕内容开口说话,助力视障用户轻松获取信息。
Brasil TTS 是一个面向巴西葡萄牙语用户的文本转语音(TTS)工具集,主要服务于视力障碍人群,帮助···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
brasiltts
开源
让巴西葡萄牙语屏幕内容开口说话,助力视障用户轻松获取信息。
Brasil TTS 是一个面向巴西葡萄牙语用户的文本转语音(TTS)工具集,主要服务于视力障碍人群,帮助···
Transformer-TTS
开源
用 Transformer 替代 RNN,快速训练语音合成模型
Transformer-TTS 是一个基于 PyTorch 实现的文本转语音(TTS)项目,对应论文《Neural Speech Synt···
NVDA-IBMTTS-Driver
开源
让 NVDA 用上经典 IBMTTS 语音,听感更自然
NVDA-IBMTTS-Driver 是一个为 NVDA 屏幕阅读器开发的 IBMTTS 语音合成驱动插件。IBMTTS 是一款与 E···
ZeroSpeech-TTS-without-T
开源
无需文本标注,直接从语音学习并合成语音,攻克低资源TTS难题。
这是一个基于PyTorch的ZeroSpeech 2019挑战赛实现,旨在解决无文本标注的语音合成(TTS-without-T)···
gmvae_tacotron
开源
用高斯混合潜变量提升语音韵律表现力,生成更自然的合成语音
gmvae_tacotron 是一个基于高斯混合变分自编码器(GM-VAE)与 Tacotron 结合的语音合成实验项目。它···
vae_tacotron2
开源
用VAE隐变量控制语音风格,让TTS更自然有表现力
VAE Tacotron 2 是一个基于变分自编码器(VAE)的语音合成(TTS)模型,作为 GST Tacotron 的替代方···
Tacotron2
开源
从文本直接生成自然语音的经典端到端 TTS 实现
Tacotron2 是一个基于 PyTorch 实现的端到端文本转语音(TTS)系统,源自 NVIDIA 的论文《Natural ···
RealTimeSingingSynthesizer
开源
用代码实时合成歌声,现场编程即兴演唱
RealTimeSingingSynthesizer 是一个基于 Python 的实时歌唱合成器,封装了 sinsy-NG 引擎,支持通过···
harmony
开源
输入旋律,自动生成符合规则的四部和声
harmony 是一个基于 Python 的开源项目,旨在通过动态规划(DP)算法自动生成遵循传统声部进行规则···
genmusic_demo_list
开源
一站式逛遍AI音乐生成Demo,快速体验前沿技术
这是一个自动音乐生成研究领域的演示网站列表,收录了众多相关项目的在线Demo入口。它解决的是研究···
alda-clj
开源
用 Clojure 实时编写并播放音乐,代码即乐谱
alda-clj 是一个基于 Clojure 的实时编程音乐库,它封装了 Alda 音乐编程语言,让开发者可以用 Clo···
blossom
开源
点点画画,即刻生成你的专属旋律
Blossom 是一个基于 JavaScript 的交互式音乐生成器,旨在让用户通过直观的图形界面轻松创作旋律。···
discord-tts-bot
开源
给 Discord 加个语音播报员,文字秒变语音
discord-tts-bot 是一个用 JavaScript 编写的 Discord 文本转语音机器人。它解决了 Discord 用户无···
Awesome-Text-to-Speech
开源
一份清单,带你速览 TTS 最新工具和模型,少走弯路。
Awesome-Text-to-Speech 是一个精心整理的文本转语音(TTS)领域资源列表,汇集了最新的工具、模型···
hum2song
开源
哼一段旋律,自动生成多轨伴奏音乐
Hum2Song 是一个基于神经网络的音乐生成工具,能够将用户哼唱的旋律自动转录并生成多轨复调音乐。它···
waveglow
开源
用流模型快速生成高质量语音波形,让 TTS 更流畅。
WaveGlow 是一个基于流的生成式神经网络,用于语音合成中的声码器环节,能将梅尔频谱图高效转换为高···
infinite_gnossienne
开源
让萨蒂的经典钢琴曲无限流淌,永不停歇。
infinite_gnossienne 是一个用 JavaScript 实现的生成式音乐项目,它基于 Erik Satie 的经典钢琴曲···
tts
开源
一行命令,用 Amazon Polly 把你的文字变成语音。
这是一个基于 Node.js 的极简文本转语音(TTS)命令行工具,核心功能是将用户输入的文本转换为语音···
cnn_vocoder
开源
用CNN快速生成语音波形,比传统声码器更快
cnn_vocoder 是一个基于卷积神经网络(CNN)的快速声码器(vocoder)开源项目,用 Python 实现。声···
mimic-recording-studio
开源
Docker 一键部署,网页录制语音样本,训练 Mimic2 专属 TTS 声音
Mimic Recording Studio 是一个基于 Docker 的语音样本录制工具,专为 Mycroft 的 Mimic2 TTS(文本···
Tacotron-pytorch
开源
用 PyTorch 复现 Tacotron,快速搭建端到端语音合成模型
Tacotron-pytorch 是一个基于 PyTorch 实现的 Tacotron 端到端文本转语音(TTS)模型。Tacotron 是···
Audio-book-generator
开源
把电子书丢进去,自动生成有声书,解放双眼听书
Audio-book-generator 是一个将电子书转换为有声书的 Python 工具。它解决的是用户没时间阅读电子书···
parrots
开源
开箱即用的中英语音识别与多角色合成引擎
parrots 是一个基于 Python 的自动语音识别(ASR)与语音合成(TTS)引擎,专注于中英语音处理。它···
musical-neural-net
开源
用 LSTM 训练 AI 生成钢琴或小提琴音乐,输入 MIDI 即出作品。
musical-neural-net 是一个用 LSTM 循环神经网络训练生成钢琴或小提琴/钢琴合奏音乐的早期开源项目···