音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

react-text-to-speech 开源

React 里几行代码搞定文字转语音,支持高亮和队列

react-text-to-speech 是一个基于 React.js 的轻量级文本转语音库,利用浏览器原生的 Web Speech A···

★ 85 评分 2022-08-17
ProDiff 开源

极速扩散语音合成,快过实时,质量不减

ProDiff 是一个基于 PyTorch 实现的语音合成项目,对应 ACM-MM'22 论文,主打极速扩散式语音合成。···

★ 432 评分 2022-08-12
vits-mandarin-biaobei 开源

用 VITS 快速生成自然普通话语音

这是一个基于 VITS 模型的中文语音合成项目,专门针对普通话 TTS 场景。它利用 Biaobei 数据集训练···

★ 121 评分 2022-08-11
PyThaiTTS 开源

用 Python 快速生成自然泰语语音,离线可用

PyThaiTTS 是一个开源的泰语文本转语音(TTS)库,基于 Python 构建,旨在为开发者提供简单易用的泰···

★ 83 评分 2022-08-11
audio-diffusion 开源

像画图一样生成音乐,给段描述就出专属旋律

利用 Hugging Face 的 diffusers 库将扩散模型应用于音乐合成,把图像生成领域的扩散技术迁移到音频···

★ 794 评分 2022-08-07
DragonianVoice 开源

用 C++ 把 SVC/TTS 模型跑起来,性能拉满,部署无忧。

DragonianVoice 是一个基于 C++ 的歌声转换(SVC)和语音合成(TTS)推理库,旨在为生产环境提供高···

★ 1129 评分 2022-08-05
AudioMAE-pytorch 开源

用掩码自编码器预训练音频模型,轻松提取通用音频特征

AudioMAE-pytorch 是掩码自编码器(Masked Autoencoder)在音频领域的非官方 PyTorch 实现,基于论···

★ 71 评分 2022-08-05
tts-vue 开源

把文字变成自然语音,一键导出音频文件

tts-vue 是一款基于微软语音合成服务的桌面工具,采用 Electron、Vue 3、Element Plus 和 Vite 构建···

★ 6097 评分 2022-07-26
tts-demo 开源

一键集成多情感男女声,实时离线都能合成,还能变声调参。

tts-demo 是一个基于 Java 的文本转语音(TTS)演示项目,集成了深度学习模型,旨在提供灵活、高质···

★ 73 评分 2022-07-20
Verbify-TTS 开源

一键朗读屏幕任意文字,免费享受AI高质语音

Verbify-TTS 是一个简单且免费的文本转语音引擎,旨在为用户朗读屏幕上的任意文本。它利用先进的 A···

★ 139 评分 2022-07-16
musicaiz 开源

一站式搞定符号音乐生成、评估与分析

musicaiz 是一个面向符号音乐生成、评估与分析的 Python 框架。它解决了音乐研究者与开发者在构建音···

★ 192 评分 2022-07-15
tts-arabic-pytorch 开源

开箱即用的阿拉伯语语音合成,支持多说话人,训练推理一条龙

这是一个基于 PyTorch 的阿拉伯语语音合成(TTS)工具包,实现了 Tacotron2 和 FastPitch 两种主流···

★ 145 评分 2022-07-13
Avocodo-pytorch 开源

用 GAN 生成无伪影语音,提升 TTS 音质

Avocodo-pytorch 是 Avocodo 声码器的 PyTorch 实现。Avocodo 是一种基于生成对抗网络(GAN)的声码···

★ 122 评分 2022-06-28
indonesian-tts 开源

用印尼语文本一键生成语音,快速集成到你的应用

这是一个面向印尼语的开源文本转语音(TTS)工具,基于Coqui TTS框架构建。它解决了印尼语语音合成···

★ 91 评分 2022-06-23
Awesome-Singing-Voice-Synthesis-and-··· 开源

一站式导航歌声合成与转换前沿资源

这是一个关于歌声合成(SVS)与歌声转换(SVC)的精选论文与项目列表,同时涵盖语音合成(TTS)、语···

★ 493 评分 2022-06-15
PitchExtractor 开源

用深度学习精准提取音高,让语音转换和TTS训练更稳定。

PitchExtractor 是一个基于深度神经网络的音高提取工具,专为语音转换和语音合成(TTS)训练设计。···

★ 154 评分 2022-06-15
text2speech 开源

让印度十亿用户用上母语语音合成

text2speech 是微软研究院实习生主导的开源项目,目标是构建面向印度十亿级用户的文本转语音(TTS)···

★ 58 评分 2022-06-14
StyleTTS 开源

用风格迁移让AI语音更有情感和表现力

StyleTTS 是一个基于 PyTorch 的文本到语音(TTS)合成项目,通过风格迁移技术让合成语音具备多样化···

★ 469 评分 2022-06-01
voice-cloning-collab 开源

用少量样本实时克隆声音,效果更自然

voice-cloning-collab 是 Real-time-voice-cloning 的改进版本,专注于实时语音克隆。它解决了原始···

★ 52 评分 2022-05-20
voicesmith 开源

一键搞定 TTS 模型训练,从数据到模型不再头疼

VoiceSmith 是一个正在开发中的语音合成工具包,旨在简化文本到语音(TTS)模型的训练流程。它主要···

★ 230 评分 2022-05-17
SyntaSpeech 开源

让 AI 朗读更有节奏感,像真人一样断句和重音

SyntaSpeech 是一个语法感知的生成对抗式文本转语音(TTS)模型,发表于 IJCAI 2022。它针对传统 T···

★ 201 评分 2022-05-12
tiktok-tts 开源

在浏览器里一键生成 TikTok 风格配音,下载即用

tiktok-tts 是一个基于浏览器的 JavaScript 工具,用于生成 TikTok 风格的文本转语音(TTS)音频。···

★ 422 评分 2022-05-06
aspeak 开源

终端里一句话调用 Azure TTS,秒出语音文件

aspeak 是一个基于 Rust 编写的极简命令行文本转语音(TTS)客户端,专门调用 Azure TTS API。它解···

★ 497 评分 2022-05-01
AdaSpeech 开源

用几秒参考音频,快速克隆出你的专属AI音色

AdaSpeech 是微软提出的自适应文本转语音(TTS)模型的非官方实现,旨在通过少量参考音频实现定制化···

★ 98 评分 2022-04-29