音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

pyttsx3 开源

离线文字转语音,一行代码让 Python 开口说话

pyttsx3 是一个纯 Python 的离线文本转语音(TTS)库,主要解决开发者在无网络环境下需要将文本转换···

★ 2534 评分 2017-06-24
voicenet 开源

用 TensorFlow 快速搭建语音合成模型,实现文本转语音。

voicenet 是一个基于 TensorFlow 和 Sonnet 构建的语音合成平台,旨在通过神经网络实现文本到语音(···

★ 60 评分 2017-06-10
music-generation-with-DL 开源

一站式导航深度学习音乐生成资源,快速入门与选型。

这是一个关于使用深度学习进行音乐生成的资源列表,汇集了论文、代码、数据集和工具,旨在帮助研究···

★ 729 评分 2017-06-08
HanTTS 开源

快速搭建中文语音合成服务,几行代码生成语音

HanTTS 是一个基于 Python 的中文文本转语音(TTS)Web 服务,旨在为开发者和用户提供简单易用的中···

★ 311 评分 2017-06-04
tacotron 开源

用 TensorFlow 复现经典端到端语音合成,从文本直接生成语音

Tacotron 是一个基于 TensorFlow 实现的端到端文本转语音(TTS)模型,源自谷歌的论文《Tacotron: ···

★ 1831 评分 2017-05-16
tacotron 开源

听Tacotron合成语音,感受端到端TTS的早期突破

Tacotron是Google提出的端到端语音合成模型,该项目是其论文的音频样本展示页。它解决了传统TTS系统···

★ 539 评分 2017-03-20
Text2Speach 开源

一句代码搞定语音合成,Java 项目快速接入 TTS

Text2Speach 是一个基于 Java 的轻量级文字转语音(TTS)工具库,旨在通过一句代码快速实现语音合成···

★ 70 评分 2017-03-01
arguing-robots 开源

在终端里看两个机器人实时吵架,还能听声

arguing-robots 是一个运行在 macOS 终端里的趣味项目,用 Crystal 语言编写。它让两个机器人角色在···

★ 53 评分 2017-02-16
cboard 开源

点图标,说出话,让沟通无碍

Cboard 是一个基于浏览器的增强与替代沟通(AAC)系统,专为言语障碍人群(如自闭症、脑瘫等)设计···

★ 758 评分 2017-02-10
tts 开源

一句代码调用 AWS Polly,快速实现文字转语音

这是一个用 JavaScript 编写的文本转语音工具集,主要目标是简化将文字转换为语音的过程。项目围绕···

★ 92 评分 2017-01-29
C-Sharp-Learning-Journey 开源

跟着C#新手项目集,快速上手WinForms和WPF开发。

这是一个C#学习历程的集合仓库,收录了作者初学C#、WinForms和WPF时制作的小项目,涵盖浏览器、暴力···

★ 189 评分 2016-12-31
talkie 开源

选中文案,一键朗读,让网页开口说话。

Talkie 是一个极简的文本转语音(TTS)浏览器扩展,以按钮形式嵌入浏览器工具栏。用户只需在任意网···

★ 79 评分 2016-12-31
articulate.js 开源

一行代码让网页开口说话,轻松实现文字转语音

articulate.js 是一个基于 jQuery 的轻量级插件,利用浏览器原生的 SpeechSynthesis API 实现文字转···

★ 138 评分 2016-12-27
amazon-polly-sample 开源

把博客文章一键变成可订阅的音频播客

amazon-polly-sample 是一个基于 Amazon Polly 的示例应用,核心功能是将任意博客文章转换为音频播···

★ 152 评分 2016-11-28
rapping-neural-network 开源

用AI生成Kanye风格说唱歌词,输入开头即出完整段落

这是一个用循环神经网络(RNN)训练的说唱歌曲生成器,专门基于Kanye West的全部音乐作品进行训练。···

★ 1064 评分 2016-11-03
tihu 开源

让波斯语文本开口说话,离线合成自然语音

tihu 是一个专为波斯语设计的文本转语音(TTS)引擎,采用 C++ 实现,核心解决波斯语特有的形态学分···

★ 85 评分 2016-10-21
read-aloud 开源

一键朗读网页,解放双眼,随时随地听内容

read-aloud 是一款开源的浏览器扩展,旨在通过一键点击将网页内容转换为语音朗读,解决视障用户、多···

★ 1751 评分 2016-10-13
MusicGenerator 开源

用 TensorFlow 玩转多种深度学习音乐生成模型

MusicGenerator 是一个基于 TensorFlow 的实验性开源项目,旨在探索多种深度学习模型在音乐生成领域···

★ 338 评分 2016-08-29
python-twelve-tone 开源

输入十二音序列,一键生成矩阵和旋律,导出 MIDI

python-twelve-tone 是一个用 Python 实现的十二音序列音乐生成工具。它解决作曲家在十二音体系(d···

★ 71 评分 2016-08-19
MangoByte 开源

在 Discord 里一键播放 Dota 英雄台词,还能 TTS 整活

MangoByte 是一个基于 Python 的 Discord 机器人,专为 Dota 2 玩家和社区设计。它解决了在 Discor···

★ 97 评分 2016-08-12
merlin 开源

用深度学习快速训练自定义语音合成模型,从文本到语音一键生成。

Merlin 是一个基于深度学习的开源语音合成工具包,专注于文本到语音(TTS)和语音转换任务。它解决···

★ 1321 评分 2016-08-10
AndroidMaryTTS 开源

在 Android 上离线生成语音,保护隐私且支持自定义声音。

AndroidMaryTTS 是一个基于 MaryTTS 的离线文本转语音(TTS)引擎,专为 Android 平台打造。它采用···

★ 201 评分 2016-07-13
text-to-speech-sample 开源

快速把文字变成带语音的视频示例

这是一个基于 Python3 的文本转语音视频示例项目,主要演示如何将文字内容转换为语音,并进一步生成···

★ 92 评分 2016-07-12
Cognitive-Speech-TTS 开源

微软官方TTS示例,快速实现文本转高质量语音

这是微软官方提供的文本转语音(TTS)示例代码集,涵盖多种编程语言,属于Azure认知服务的一部分。···

★ 1013 评分 2016-05-31