音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

wyoming-piper-gpu 开源

给 Home Assistant 的 Piper 语音装上 GPU 加速,秒级响应

wyoming-piper-gpu 是一个为 Home Assistant 提供 GPU 加速的 Piper 文本转语音(TTS)服务的 Dock···

★ 57 评分 2023-12-08
ComfyUI-audio 开源

在 ComfyUI 里拖拽节点,轻松生成音乐和语音

ComfyUI-audio 是一个为 ComfyUI 平台开发的音频生成工具集,旨在将音乐生成、文本转语音等音频能力···

★ 106 评分 2023-12-06
OpenVoice 开源

给一段录音,立刻复刻出同款声音,谁都能当配音员

由 MIT 与 MyShell 联合打造的开源音频基础模型,支持即时声音克隆。仅需一段参考音频即可克隆任意···

★ 37682 评分 2023-11-29
OpenAI-Audiobook-Generator 开源

输入文本,一键生成有声书音频

这是一个基于网页的文本转音频工具,专注于生成有声书。它利用OpenAI的语音合成能力,将用户提供的···

★ 86 评分 2023-11-28
tortoise.cpp 开源

在本地 CPU 上快速跑通 tortoise-tts,无需 GPU 也能语音合成。

tortoise.cpp 是 tortoise-tts 的 ggml (C++) 重新实现,旨在将高质量文本转语音模型本地化运行。它···

★ 191 评分 2023-11-25
xtts2-ui 开源

上传10秒语音,即刻克隆声音并生成任意文本语音

xtts2-ui 是一个为 Coqui XTTS-2 模型打造的图形化界面工具,让用户仅需 10 秒的语音样本即可完成文···

★ 403 评分 2023-11-25
obsidian-aloud-tts 开源

在 Obsidian 里选中文字就能听,边记边听提效率

obsidian-aloud-tts 是一个 Obsidian 的文本转语音(TTS)插件,用 TypeScript 编写,结合 React 和···

★ 97 评分 2023-11-24
xtts-api-server 开源

一键部署XTTSv2,快速实现多语言语音合成与克隆

xtts-api-server 是一个基于 FastAPI 的轻量级服务端,用于部署和运行 Coqui AI 的 XTTSv2 文本转语···

★ 596 评分 2023-11-20
OpenAI-Text-To-Speech-for-Unity 开源

在Unity中一键调用OpenAI语音合成,让应用开口说话

这是一个Unity插件,将OpenAI的文本转语音(TTS)能力集成到Unity引擎中。它解决了Unity开发者需要···

★ 88 评分 2023-11-19
clone-voice 开源

上传声音样本,即刻克隆音色生成语音

clone-voice 是一个带 Web 界面的声音克隆工具,使用 Python 编写。它允许用户用自己的音色或任意声···

★ 8969 评分 2023-11-19
text_generation_webui_xtts 开源

给文本生成界面加上XTTSv2语音输出,让AI开口说话

text_generation_webui_xtts 是一个为 oobabooga text-generation-webui 设计的 XTTSv2 扩展插件。···

★ 156 评分 2023-11-18
VoxNovel 开源

一键把电子书变成多人配音的有声书

VoxNovel 是一个将电子书转换为有声书的开源工具,核心特点是能为书中每个角色分配不同的配音演员,···

★ 375 评分 2023-11-17
Amphion 开源

一站式音频生成工具箱,快速上手语音、音乐与歌声合成

Amphion 是一个面向音频、音乐和语音生成的开源工具包,旨在支持可复现研究,并帮助初级研究者和工···

★ 10308 评分 2023-11-15
mustango 开源

用自然语言精准控制音乐生成,让每句描述都变成旋律。

Mustango是一个面向可控文本生成音乐的开源模型,旨在解决现有文本到音乐生成中控制能力弱、语义对···

★ 396 评分 2023-11-14
OpenAI-TTS-Gradio 开源

拖拽文本,一键生成 OpenAI 语音,无需写代码。

OpenAI-TTS-Gradio 是一个基于 Gradio 构建的轻量级 Web 界面,用于调用 OpenAI 的文本转语音(TTS···

★ 60 评分 2023-11-12
pflowtts_pytorch 开源

用 flow matching 快速生成自然语音,复现 NVIDIA 论文效果

P-Flow TTS 的非官方 PyTorch 实现,基于 NVIDIA 的论文,采用 flow matching 技术进行文本到语音合···

★ 228 评分 2023-11-11
openai_tts 开源

让 Home Assistant 用上 OpenAI 高质量语音,播报更自然

这是一个为 Home Assistant 打造的自定义文本转语音(TTS)组件,利用 OpenAI 的语音合成引擎或任何···

★ 217 评分 2023-11-10
EmotiVoice 开源

打几个字就能让配音带情绪,开心难过随你指挥

网易有道开源的多音色、提示词可控 TTS 引擎,通过文本提示即可控制合成语音的情感与风格。支持多种···

★ 8531 评分 2023-11-08
open-audio 开源

输入文字,一键生成自然语音并下载

Open-Audio 是一个基于 OpenAI 文本转语音(TTS)模型的 Web 应用,旨在将文字快速转换为自然流畅的···

★ 95 评分 2023-11-08
ospeak 开源

终端里一句话,文本秒变语音文件

ospeak 是一个基于 Python 的 CLI 工具,用于调用 OpenAI 的文本转语音(TTS)API。它解决了开发者···

★ 170 评分 2023-11-07
CapCut-TTS 开源

免费把剪映 TTS 变成 API,快速接入你的应用

CapCut-TTS 是一个基于 TypeScript 开发的轻量级 API 封装工具,旨在将剪映(CapCut)内置的文本转···

★ 111 评分 2023-11-05
awesome-ai-music-generation 开源

一网打尽AI音乐生成工具,快速找到你需要的创作利器。

这是一个精选的AI音乐生成资源与项目合集,旨在整理和展示利用机器学习算法进行音乐创作的开源工具···

★ 498 评分 2023-11-03
lobe-tts 开源

一行代码接入多平台语音合成与识别,服务端浏览器通吃。

Lobe TTS 是一个基于 TypeScript 的高质量、可靠的语音合成(TTS)与语音识别(STT)库,专为服务端···

★ 804 评分 2023-11-02
UniCATS-CTX-txt2vec 开源

用扩散模型生成自然语音,让 TTS 更有表现力

UniCATS-CTX-txt2vec 是 AAAI 2024 论文中 UniCATS 语音合成系统的声学模型组件,基于 VQ-Diffusio···

★ 64 评分 2023-10-31