react-text-to-speech
开源
React 里几行代码搞定文字转语音,支持高亮和队列
react-text-to-speech 是一个基于 React.js 的轻量级文本转语音库,利用浏览器原生的 Web Speech A···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
react-text-to-speech
开源
React 里几行代码搞定文字转语音,支持高亮和队列
react-text-to-speech 是一个基于 React.js 的轻量级文本转语音库,利用浏览器原生的 Web Speech A···
ProDiff
开源
极速扩散语音合成,快过实时,质量不减
ProDiff 是一个基于 PyTorch 实现的语音合成项目,对应 ACM-MM'22 论文,主打极速扩散式语音合成。···
vits-mandarin-biaobei
开源
用 VITS 快速生成自然普通话语音
这是一个基于 VITS 模型的中文语音合成项目,专门针对普通话 TTS 场景。它利用 Biaobei 数据集训练···
PyThaiTTS
开源
用 Python 快速生成自然泰语语音,离线可用
PyThaiTTS 是一个开源的泰语文本转语音(TTS)库,基于 Python 构建,旨在为开发者提供简单易用的泰···
audio-diffusion
开源
像画图一样生成音乐,给段描述就出专属旋律
利用 Hugging Face 的 diffusers 库将扩散模型应用于音乐合成,把图像生成领域的扩散技术迁移到音频···
DragonianVoice
开源
用 C++ 把 SVC/TTS 模型跑起来,性能拉满,部署无忧。
DragonianVoice 是一个基于 C++ 的歌声转换(SVC)和语音合成(TTS)推理库,旨在为生产环境提供高···
AudioMAE-pytorch
开源
用掩码自编码器预训练音频模型,轻松提取通用音频特征
AudioMAE-pytorch 是掩码自编码器(Masked Autoencoder)在音频领域的非官方 PyTorch 实现,基于论···
tts-vue
开源
把文字变成自然语音,一键导出音频文件
tts-vue 是一款基于微软语音合成服务的桌面工具,采用 Electron、Vue 3、Element Plus 和 Vite 构建···
tts-demo
开源
一键集成多情感男女声,实时离线都能合成,还能变声调参。
tts-demo 是一个基于 Java 的文本转语音(TTS)演示项目,集成了深度学习模型,旨在提供灵活、高质···
Verbify-TTS
开源
一键朗读屏幕任意文字,免费享受AI高质语音
Verbify-TTS 是一个简单且免费的文本转语音引擎,旨在为用户朗读屏幕上的任意文本。它利用先进的 A···
musicaiz
开源
一站式搞定符号音乐生成、评估与分析
musicaiz 是一个面向符号音乐生成、评估与分析的 Python 框架。它解决了音乐研究者与开发者在构建音···
tts-arabic-pytorch
开源
开箱即用的阿拉伯语语音合成,支持多说话人,训练推理一条龙
这是一个基于 PyTorch 的阿拉伯语语音合成(TTS)工具包,实现了 Tacotron2 和 FastPitch 两种主流···
Avocodo-pytorch
开源
用 GAN 生成无伪影语音,提升 TTS 音质
Avocodo-pytorch 是 Avocodo 声码器的 PyTorch 实现。Avocodo 是一种基于生成对抗网络(GAN)的声码···
indonesian-tts
开源
用印尼语文本一键生成语音,快速集成到你的应用
这是一个面向印尼语的开源文本转语音(TTS)工具,基于Coqui TTS框架构建。它解决了印尼语语音合成···
Awesome-Singing-Voice-Synthesis-and-···
开源
一站式导航歌声合成与转换前沿资源
这是一个关于歌声合成(SVS)与歌声转换(SVC)的精选论文与项目列表,同时涵盖语音合成(TTS)、语···
PitchExtractor
开源
用深度学习精准提取音高,让语音转换和TTS训练更稳定。
PitchExtractor 是一个基于深度神经网络的音高提取工具,专为语音转换和语音合成(TTS)训练设计。···
text2speech
开源
让印度十亿用户用上母语语音合成
text2speech 是微软研究院实习生主导的开源项目,目标是构建面向印度十亿级用户的文本转语音(TTS)···
StyleTTS
开源
用风格迁移让AI语音更有情感和表现力
StyleTTS 是一个基于 PyTorch 的文本到语音(TTS)合成项目,通过风格迁移技术让合成语音具备多样化···
voice-cloning-collab
开源
用少量样本实时克隆声音,效果更自然
voice-cloning-collab 是 Real-time-voice-cloning 的改进版本,专注于实时语音克隆。它解决了原始···
voicesmith
开源
一键搞定 TTS 模型训练,从数据到模型不再头疼
VoiceSmith 是一个正在开发中的语音合成工具包,旨在简化文本到语音(TTS)模型的训练流程。它主要···
SyntaSpeech
开源
让 AI 朗读更有节奏感,像真人一样断句和重音
SyntaSpeech 是一个语法感知的生成对抗式文本转语音(TTS)模型,发表于 IJCAI 2022。它针对传统 T···
tiktok-tts
开源
在浏览器里一键生成 TikTok 风格配音,下载即用
tiktok-tts 是一个基于浏览器的 JavaScript 工具,用于生成 TikTok 风格的文本转语音(TTS)音频。···
aspeak
开源
终端里一句话调用 Azure TTS,秒出语音文件
aspeak 是一个基于 Rust 编写的极简命令行文本转语音(TTS)客户端,专门调用 Azure TTS API。它解···
AdaSpeech
开源
用几秒参考音频,快速克隆出你的专属AI音色
AdaSpeech 是微软提出的自适应文本转语音(TTS)模型的非官方实现,旨在通过少量参考音频实现定制化···