pytorch-dc-tts
开源
用 PyTorch 快速训练中英蒙三语语音合成模型
pytorch-dc-tts 是一个基于 PyTorch 实现的文本转语音(TTS)项目,支持英语和蒙古语。它复现了 DC···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
pytorch-dc-tts
开源
用 PyTorch 快速训练中英蒙三语语音合成模型
pytorch-dc-tts 是一个基于 PyTorch 实现的文本转语音(TTS)项目,支持英语和蒙古语。它复现了 DC···
Neural-Voice-Cloning-With-Few-Sample···
开源
用几秒样本,克隆任意人的声音
这是一个基于论文《Neural Voice Cloning With Few Samples》的开源实现,旨在解决少样本语音克隆问···
BeatDrop
开源
把音乐变成动态视觉,实时跟随节奏跳动
BeatDrop 是一个基于 C++ 开发的音乐可视化工具,专注于将音频输入实时转化为动态视觉效果。它解决···
TTS-Cube
开源
用RNN端到端合成语音,从文本到波形一步到位
TTS-Cube 是一个基于循环神经网络的端到端语音合成项目,旨在直接从文本生成语音波形,解决传统TTS···
FFTNet
开源
用 FFT 加速神经声码器,实现实时语音合成。
FFTNet 是一个基于 FFT 的实时、说话人相关的神经声码器,用于语音合成(TTS)系统中的波形生成。它···
WaveGAN-pytorch
开源
用 PyTorch 从零训练 GAN 直接生成原始音频波形
WaveGAN-pytorch 是论文《Synthesizing Audio with Generative Adversarial Networks》的 PyTorch ···
midi2voice
开源
上传 MIDI,一键生成人声演唱,快速试听旋律效果。
midi2voice 是一个基于 Python 的开源歌声合成工具,旨在将 MIDI 文件直接转换为逼真的人声演唱。它···
dctts-pytorch
开源
用卷积网络快速训练你的中文语音合成模型
DC-TTS 的 PyTorch 非官方实现,基于论文《Efficiently Trainable Text-to-Speech System Based on···
GST-Tacotron
开源
给语音合成装上风格旋钮,一句话控制情感语调
GST-Tacotron 是一个基于 PyTorch 实现的端到端语音合成系统,核心是引入全局风格令牌(GST)机制,···
Dicy2
开源
在 Max 里用机器学习生成音乐序列,实现交互式创作
Dicy2 是一个基于 Max 的交互式音乐生成工具包,利用机器学习技术生成音乐序列,并可与作曲流程或即···
generative.fm
开源
打开网页,聆听永不重复的算法生成音乐
generative.fm 是一个在浏览器中播放生成式音乐的平台。它解决了传统音乐播放器只能播放固定曲目的···
Selection-js
开源
选中文本,即刻弹出操作菜单,让复制、搜索、分享一步到位。
Selection-js 是一个轻量级的 JavaScript 库,用于在用户选中网页文本时,于选区上方弹出一个小型操···
Text-Normalization-Demo
开源
用记忆增强神经网络,一键把口语化文本转成规范写法
这是一个文本规范化(Text Normalization)的演示项目,对应论文《Text Normalization using Memor···
speech-tts-cors
开源
绕过跨域限制,一行代码让网页开口说话
这是一个基于百度语音合成API的跨域演示项目及轻量级支持库。它解决了浏览器直接调用百度TTS接口时···
flutter_tts
开源
一行代码让 Flutter 应用开口说话,跨平台 TTS 轻松搞定
flutter_tts 是一个 Flutter 文本转语音(TTS)插件,为 Flutter 应用提供跨平台的语音合成能力。它···
doc2audiobook
开源
把文档变成有声书,通勤路上用耳朵学习
doc2audiobook 是一个将文本文档转换为高保真音频(有声书)的开源工具。它主要解决用户需要将 PDF···
Neural-Voice-Cloning-with-Few-Sample···
开源
用几句话克隆你的声音,快速生成个性化语音
这是一个基于百度研究论文《Neural Voice Cloning with Few Samples》的Python实现,旨在用少量样本···
ng2-pdfjs-viewer
开源
在 Angular 里快速嵌入 PDF 查看器,支持表单和自定义
ng2-pdfjs-viewer 是一个基于 PDF.js 的 Angular PDF 查看器组件,专为 Angular 2+ 设计,目前支持···
bmusegan
开源
用二值神经元GAN生成复调钢琴曲,适合AI作曲研究
bmusegan 是一个基于卷积生成对抗网络(GAN)的复调音乐生成开源项目,对应论文《Convolutional Ge···
speaker_adapted_tts
开源
1分钟语音样本,10分钟训练出你的专属TTS模型
这是一个针对特定说话人进行语音合成(TTS)适配的开源项目,核心目标是让用户仅需提供1分钟的语音···
WaveRNN
开源
用 WaveRNN 快速生成高保真语音,让 TTS 更自然流畅
WaveRNN 是一个基于 PyTorch 的神经声码器与语音合成(TTS)项目,由 fatchord 开发。它实现了 Wav···
esp8266-google-tts
开源
用ESP8266连WiFi,把文字变成语音播出来
esp8266-google-tts 是一个基于 ESP8266 芯片的文本转语音(TTS)库,它通过调用 Google 翻译的 TT···
voice-builder
开源
拖拽式搭建自定义语音,快速生成 TTS 模型
voice-builder 是一个开源的文本转语音(TTS)语音构建工具,基于 JavaScript 开发,整合了 festvo···
WillFromAfarDownloader
开源
一键批量抓取 acapellabox 无伴奏音频,省时省力
WillFromAfarDownloader 是一个针对 acapellabox 网站的音乐下载工具,以 C# 编写。它解决的问题是···