cs224n-gpu-that-talks
开源
用注意力机制端到端合成语音,简化传统TTS流程
这是一个基于CS224n课程项目开发的端到端语音合成系统,名为“Attention, I'm Trying to Speak”。···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
cs224n-gpu-that-talks
开源
用注意力机制端到端合成语音,简化传统TTS流程
这是一个基于CS224n课程项目开发的端到端语音合成系统,名为“Attention, I'm Trying to Speak”。···
TTS
开源
训练并部署高拟真语音合成模型,轻松打造专属声音
Mozilla TTS 是一个基于深度学习的文本转语音(TTS)引擎,旨在提供高质量、自然且灵活的语音合成能···
pypianoroll
开源
把 MIDI 变成钢琴卷帘,方便做音乐 AI 训练和可视化。
pypianoroll 是一个用于处理钢琴卷帘(piano roll)格式音乐数据的 Python 工具包。它解决了音乐信···
Tacotron-2
开源
用 TensorFlow 复现 DeepMind 端到端语音合成,一键训练出自然语音
Tacotron-2 是 DeepMind 提出的端到端文本转语音(TTS)模型的 TensorFlow 实现。它解决传统语音合···
htgo-tts
开源
Go 语言里几行代码生成语音,无需外部服务
htgo-tts 是一个用 Go 语言编写的文本转语音(TTS)库,旨在为 Go 开发者提供简单、轻量的语音合成···
totalvoice-node
开源
用 Node.js 快速集成 Totalvoice 语音和短信服务
totalvoice-node 是一个用于 Node.js 的客户端库,封装了 Totalvoice 的 REST API,让开发者能够通···
izabela-desktop
开源
全局打字即语音,游戏聊天不开口
izabela-desktop 是一个文本转语音(TTS)的概念验证应用,核心特点是支持全局打字输入,即用户可以···
Tacotron-pytorch
开源
用 PyTorch 快速上手 Tacotron,训练自己的语音合成模型
Tacotron-pytorch 是一个基于 PyTorch 实现的 Tacotron 文本转语音(TTS)模型,旨在将文本序列转换···
dc_tts
开源
用 TensorFlow 快速训练轻量级语音合成模型,适合研究入门
dc_tts 是一个基于 TensorFlow 实现的端到端文本转语音(TTS)模型,源自论文“Efficiently Traina···
MTTS
开源
把中文文本变成语音合成可用的声学特征,一步到位
MTTS 是一个面向普通话/中文的文本转语音(TTS)前端演示项目,主要聚焦于中文语音合成的前端处理环···
Keras_music_gereration
开源
用LSTM自动学旋律,生成新音乐片段
这是一个基于Keras和LSTM的早期音乐生成项目,使用Jupyter Notebook编写。它主要解决如何利用深度学···
deepvoice3_pytorch
开源
用 PyTorch 复现百度 Deep Voice 3,快速训练文本转语音模型
deepvoice3_pytorch 是百度 Deep Voice 3 文本转语音(TTS)模型的 PyTorch 非官方实现。Deep Voic···
spoken-word
开源
在网页里轻松搞定语音音频处理
Spoken Word 是一个基于 JavaScript 的音频处理开源项目,专注于语音相关功能。它解决的是在 Web 环···
joytan
开源
一键把文本变成带音频的Anki卡片和有声书
Joytan是一个面向语言学习和有声书创作的Python开源工具,它将文本、音频和记忆卡片生成整合在一个···
JamBot
开源
用 Python 自动化音乐制作,快速生成混音灵感。
JamBot 是一个基于 Python 的开源音频音乐项目,旨在通过自动化方式辅助音乐创作与混音。它解决音乐···
musegan
开源
一句话生成乐队合奏,钢琴吉他鼓点全齐活
MuseGAN 是一个基于生成对抗网络的音乐生成模型,可生成多轨、多乐器协同的复调音乐,支持钢琴曲与···
serverless-medium-text-to-speech
开源
输入Medium文章链接,一键生成可听的音频版
这是一个基于Serverless架构的文本转语音服务,专为Medium文章设计。它解决了Medium平台缺乏原生朗···
magphase
开源
用幅度和相位重建自然语音,让 TTS 发声更真实
MagPhase 是一个基于 Python 的开源声码器,用于语音分析与合成,主要面向文本转语音(TTS)及相关···
SAPI4
开源
在浏览器里复活微软 Sam 老语音,一键合成怀旧音频
SAPI4 是一个基于 Web 的文本转语音(TTS)接口,专门用于调用微软经典的 SAPI4 语音引擎(如 Micr···
EDDI
开源
玩《精英危险》时,用语音播报和实时数据,让你不切屏也能掌握全局。
EDDI 是《精英危险》(Elite Dangerous)游戏的伴侣应用,专为提升游戏体验而设计。它通过监听游戏···
tensorflow-music-generator
开源
喂给 MIDI 示例,自动学风格并生成新旋律
这是一个用 TensorFlow 构建的循环神经网络(RNN)音乐生成器,能够根据给定的 MIDI 文件学习音乐风···
ha-tts-bluetooth-speaker
开源
让 Home Assistant 用蓝牙音箱说话,无需额外硬件
这是一个为 Home Assistant 设计的 TTS 蓝牙音箱组件。它解决了将 Home Assistant 的文本转语音(T···
tacotron
开源
用 TensorFlow 复现谷歌 Tacotron,快速实现文本转语音
Tacotron 是一个基于 TensorFlow 的非官方实现,复现了 Google 的 Tacotron 语音合成模型,并提供了···
nnmnkwii
开源
快速搭建语音合成原型,专注算法验证与实验。
nnmnkwii 是一个用于构建语音合成系统的 Python 库,专注于快速原型设计和实验。它提供了一套简洁的···