音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

pytorch-dc-tts 开源

用 PyTorch 快速训练中英蒙三语语音合成模型

pytorch-dc-tts 是一个基于 PyTorch 实现的文本转语音(TTS)项目,支持英语和蒙古语。它复现了 DC···

★ 186 评分 2018-08-10
BeatDrop 开源

把音乐变成动态视觉,实时跟随节奏跳动

BeatDrop 是一个基于 C++ 开发的音乐可视化工具,专注于将音频输入实时转化为动态视觉效果。它解决···

★ 94 评分 2018-07-22
TTS-Cube 开源

用RNN端到端合成语音,从文本到波形一步到位

TTS-Cube 是一个基于循环神经网络的端到端语音合成项目,旨在直接从文本生成语音波形,解决传统TTS···

★ 223 评分 2018-07-21
FFTNet 开源

用 FFT 加速神经声码器,实现实时语音合成。

FFTNet 是一个基于 FFT 的实时、说话人相关的神经声码器,用于语音合成(TTS)系统中的波形生成。它···

★ 64 评分 2018-07-18
WaveGAN-pytorch 开源

用 PyTorch 从零训练 GAN 直接生成原始音频波形

WaveGAN-pytorch 是论文《Synthesizing Audio with Generative Adversarial Networks》的 PyTorch ···

★ 66 评分 2018-07-16
midi2voice 开源

上传 MIDI,一键生成人声演唱,快速试听旋律效果。

midi2voice 是一个基于 Python 的开源歌声合成工具,旨在将 MIDI 文件直接转换为逼真的人声演唱。它···

★ 286 评分 2018-07-10
dctts-pytorch 开源

用卷积网络快速训练你的中文语音合成模型

DC-TTS 的 PyTorch 非官方实现,基于论文《Efficiently Trainable Text-to-Speech System Based on···

★ 76 评分 2018-06-15
GST-Tacotron 开源

给语音合成装上风格旋钮,一句话控制情感语调

GST-Tacotron 是一个基于 PyTorch 实现的端到端语音合成系统,核心是引入全局风格令牌(GST)机制,···

★ 375 评分 2018-05-26
Dicy2 开源

在 Max 里用机器学习生成音乐序列,实现交互式创作

Dicy2 是一个基于 Max 的交互式音乐生成工具包,利用机器学习技术生成音乐序列,并可与作曲流程或即···

★ 64 评分 2018-05-16
generative.fm 开源

打开网页,聆听永不重复的算法生成音乐

generative.fm 是一个在浏览器中播放生成式音乐的平台。它解决了传统音乐播放器只能播放固定曲目的···

★ 1588 评分 2018-05-06
Selection-js 开源

选中文本,即刻弹出操作菜单,让复制、搜索、分享一步到位。

Selection-js 是一个轻量级的 JavaScript 库,用于在用户选中网页文本时,于选区上方弹出一个小型操···

★ 95 评分 2018-04-16
Text-Normalization-Demo 开源

用记忆增强神经网络,一键把口语化文本转成规范写法

这是一个文本规范化(Text Normalization)的演示项目,对应论文《Text Normalization using Memor···

★ 60 评分 2018-04-13
speech-tts-cors 开源

绕过跨域限制,一行代码让网页开口说话

这是一个基于百度语音合成API的跨域演示项目及轻量级支持库。它解决了浏览器直接调用百度TTS接口时···

★ 108 评分 2018-04-13
flutter_tts 开源

一行代码让 Flutter 应用开口说话,跨平台 TTS 轻松搞定

flutter_tts 是一个 Flutter 文本转语音(TTS)插件,为 Flutter 应用提供跨平台的语音合成能力。它···

★ 753 评分 2018-04-10
doc2audiobook 开源

把文档变成有声书,通勤路上用耳朵学习

doc2audiobook 是一个将文本文档转换为高保真音频(有声书)的开源工具。它主要解决用户需要将 PDF···

★ 203 评分 2018-03-31
Neural-Voice-Cloning-with-Few-Sample··· 开源

用几句话克隆你的声音,快速生成个性化语音

这是一个基于百度研究论文《Neural Voice Cloning with Few Samples》的Python实现,旨在用少量样本···

★ 254 评分 2018-03-30
ng2-pdfjs-viewer 开源

在 Angular 里快速嵌入 PDF 查看器,支持表单和自定义

ng2-pdfjs-viewer 是一个基于 PDF.js 的 Angular PDF 查看器组件,专为 Angular 2+ 设计,目前支持···

★ 253 评分 2018-03-29
bmusegan 开源

用二值神经元GAN生成复调钢琴曲,适合AI作曲研究

bmusegan 是一个基于卷积生成对抗网络(GAN)的复调音乐生成开源项目,对应论文《Convolutional Ge···

★ 58 评分 2018-03-24
speaker_adapted_tts 开源

1分钟语音样本,10分钟训练出你的专属TTS模型

这是一个针对特定说话人进行语音合成(TTS)适配的开源项目,核心目标是让用户仅需提供1分钟的语音···

★ 184 评分 2018-03-17
WaveRNN 开源

用 WaveRNN 快速生成高保真语音,让 TTS 更自然流畅

WaveRNN 是一个基于 PyTorch 的神经声码器与语音合成(TTS)项目,由 fatchord 开发。它实现了 Wav···

★ 2191 评分 2018-03-16
esp8266-google-tts 开源

用ESP8266连WiFi,把文字变成语音播出来

esp8266-google-tts 是一个基于 ESP8266 芯片的文本转语音(TTS)库,它通过调用 Google 翻译的 TT···

★ 81 评分 2018-03-13
voice-builder 开源

拖拽式搭建自定义语音,快速生成 TTS 模型

voice-builder 是一个开源的文本转语音(TTS)语音构建工具,基于 JavaScript 开发,整合了 festvo···

★ 688 评分 2018-03-05
WillFromAfarDownloader 开源

一键批量抓取 acapellabox 无伴奏音频,省时省力

WillFromAfarDownloader 是一个针对 acapellabox 网站的音乐下载工具,以 C# 编写。它解决的问题是···

★ 106 评分 2018-02-28