音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

cs224n-gpu-that-talks 开源

用注意力机制端到端合成语音,简化传统TTS流程

这是一个基于CS224n课程项目开发的端到端语音合成系统,名为“Attention, I'm Trying to Speak”。···

★ 52 评分 2018-02-15
TTS 开源

训练并部署高拟真语音合成模型,轻松打造专属声音

Mozilla TTS 是一个基于深度学习的文本转语音(TTS)引擎,旨在提供高质量、自然且灵活的语音合成能···

★ 10172 评分 2018-01-23
pypianoroll 开源

把 MIDI 变成钢琴卷帘,方便做音乐 AI 训练和可视化。

pypianoroll 是一个用于处理钢琴卷帘(piano roll)格式音乐数据的 Python 工具包。它解决了音乐信···

★ 148 评分 2018-01-13
Tacotron-2 开源

用 TensorFlow 复现 DeepMind 端到端语音合成,一键训练出自然语音

Tacotron-2 是 DeepMind 提出的端到端文本转语音(TTS)模型的 TensorFlow 实现。它解决传统语音合···

★ 2321 评分 2017-12-20
htgo-tts 开源

Go 语言里几行代码生成语音,无需外部服务

htgo-tts 是一个用 Go 语言编写的文本转语音(TTS)库,旨在为 Go 开发者提供简单、轻量的语音合成···

★ 219 评分 2017-12-14
totalvoice-node 开源

用 Node.js 快速集成 Totalvoice 语音和短信服务

totalvoice-node 是一个用于 Node.js 的客户端库,封装了 Totalvoice 的 REST API,让开发者能够通···

★ 62 评分 2017-12-08
izabela-desktop 开源

全局打字即语音,游戏聊天不开口

izabela-desktop 是一个文本转语音(TTS)的概念验证应用,核心特点是支持全局打字输入,即用户可以···

★ 84 评分 2017-12-02
Tacotron-pytorch 开源

用 PyTorch 快速上手 Tacotron,训练自己的语音合成模型

Tacotron-pytorch 是一个基于 PyTorch 实现的 Tacotron 文本转语音(TTS)模型,旨在将文本序列转换···

★ 206 评分 2017-11-23
dc_tts 开源

用 TensorFlow 快速训练轻量级语音合成模型,适合研究入门

dc_tts 是一个基于 TensorFlow 实现的端到端文本转语音(TTS)模型,源自论文“Efficiently Traina···

★ 1159 评分 2017-11-23
MTTS 开源

把中文文本变成语音合成可用的声学特征,一步到位

MTTS 是一个面向普通话/中文的文本转语音(TTS)前端演示项目,主要聚焦于中文语音合成的前端处理环···

★ 284 评分 2017-11-22
Keras_music_gereration 开源

用LSTM自动学旋律,生成新音乐片段

这是一个基于Keras和LSTM的早期音乐生成项目,使用Jupyter Notebook编写。它主要解决如何利用深度学···

★ 105 评分 2017-11-07
deepvoice3_pytorch 开源

用 PyTorch 复现百度 Deep Voice 3,快速训练文本转语音模型

deepvoice3_pytorch 是百度 Deep Voice 3 文本转语音(TTS)模型的 PyTorch 非官方实现。Deep Voic···

★ 1976 评分 2017-10-31
spoken-word 开源

在网页里轻松搞定语音音频处理

Spoken Word 是一个基于 JavaScript 的音频处理开源项目,专注于语音相关功能。它解决的是在 Web 环···

★ 51 评分 2017-10-06
joytan 开源

一键把文本变成带音频的Anki卡片和有声书

Joytan是一个面向语言学习和有声书创作的Python开源工具,它将文本、音频和记忆卡片生成整合在一个···

★ 140 评分 2017-10-05
JamBot 开源

用 Python 自动化音乐制作,快速生成混音灵感。

JamBot 是一个基于 Python 的开源音频音乐项目,旨在通过自动化方式辅助音乐创作与混音。它解决音乐···

★ 64 评分 2017-09-18
musegan 开源

一句话生成乐队合奏,钢琴吉他鼓点全齐活

MuseGAN 是一个基于生成对抗网络的音乐生成模型,可生成多轨、多乐器协同的复调音乐,支持钢琴曲与···

★ 2045 评分 2017-09-13
serverless-medium-text-to-speech 开源

输入Medium文章链接,一键生成可听的音频版

这是一个基于Serverless架构的文本转语音服务,专为Medium文章设计。它解决了Medium平台缺乏原生朗···

★ 95 评分 2017-08-28
magphase 开源

用幅度和相位重建自然语音,让 TTS 发声更真实

MagPhase 是一个基于 Python 的开源声码器,用于语音分析与合成,主要面向文本转语音(TTS)及相关···

★ 80 评分 2017-08-19
SAPI4 开源

在浏览器里复活微软 Sam 老语音,一键合成怀旧音频

SAPI4 是一个基于 Web 的文本转语音(TTS)接口,专门用于调用微软经典的 SAPI4 语音引擎(如 Micr···

★ 139 评分 2017-08-15
EDDI 开源

玩《精英危险》时,用语音播报和实时数据,让你不切屏也能掌握全局。

EDDI 是《精英危险》(Elite Dangerous)游戏的伴侣应用,专为提升游戏体验而设计。它通过监听游戏···

★ 526 评分 2017-08-04
tensorflow-music-generator 开源

喂给 MIDI 示例,自动学风格并生成新旋律

这是一个用 TensorFlow 构建的循环神经网络(RNN)音乐生成器,能够根据给定的 MIDI 文件学习音乐风···

★ 129 评分 2017-08-03
ha-tts-bluetooth-speaker 开源

让 Home Assistant 用蓝牙音箱说话,无需额外硬件

这是一个为 Home Assistant 设计的 TTS 蓝牙音箱组件。它解决了将 Home Assistant 的文本转语音(T···

★ 210 评分 2017-07-10
tacotron 开源

用 TensorFlow 复现谷歌 Tacotron,快速实现文本转语音

Tacotron 是一个基于 TensorFlow 的非官方实现,复现了 Google 的 Tacotron 语音合成模型,并提供了···

★ 2997 评分 2017-07-08
nnmnkwii 开源

快速搭建语音合成原型,专注算法验证与实验。

nnmnkwii 是一个用于构建语音合成系统的 Python 库,专注于快速原型设计和实验。它提供了一套简洁的···

★ 399 评分 2017-07-05