音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

obs-squawk 开源

在 OBS 里直接生成实时 AI 语音,直播播报不用切软件

obs-squawk 是一个内置于 OBS Studio 的实时文本转语音(TTS)AI 引擎插件,采用 C++ 编写。它解决···

★ 71 评分 2024-06-17
praises 开源

把文字变成语音,轻松听书、配音、学外语。

Praises 是一款基于 Tauri 和 Vue 的跨平台文本转语音(TTS)桌面工具,主要解决用户快速将文字转换···

★ 270 评分 2024-06-13
audiotoken 开源

极速音频转令牌,让音频生成快人一步

audiotoken 是一个专注于音频令牌化的开源项目,旨在以最快的方式将音频信号转换为离散的令牌序列,···

★ 56 评分 2024-06-07
TTSlist 开源

10000条ChatTTS音色随便挑,告别音色抽卡烦恼

TTSlist 是一个为 ChatTTS 文本转语音模型打造的音色库,收录了 10000 条预生成的音色样本,解决用···

★ 262 评分 2024-06-06
ChatTTS-OpenVoice 开源

上传10秒音频,克隆你的专属ChatTTS音色

ChatTTS-OpenVoice 是一个将 ChatTTS 与 OpenVoice 融合的开源语音克隆工具。它解决的核心问题是:···

★ 466 评分 2024-06-05
HebTTS 开源

跳过元音预测,直接让AI用希伯来语开口说话

HebTTS 是论文《A Language Modeling Approach to Diacritic-Free Hebrew TTS》的官方实现,旨在解···

★ 112 评分 2024-06-05
MARS5-TTS 开源

几秒音频克隆音色,生成富有情感的语音

MARS5-TTS 是 CAMB.AI 开源的语音合成模型,专注于高表现力的文本转语音和声音克隆。它解决的核心问···

★ 2822 评分 2024-06-03
ControlSpeech 开源

几秒克隆音色,同时随心控制说话风格

ControlSpeech 是一个基于 ACL 2025 论文的零样本语音克隆与语言风格控制开源项目。它解决的核心问···

★ 277 评分 2024-06-02
chattts-seed-example 开源

试听 ChatTTS 各音色,快速挑中你喜欢的 seed

chattts-seed-example 是一个面向 ChatTTS 用户的音色种子示例库。ChatTTS 是一个文本转语音模型,···

★ 59 评分 2024-06-02
Speech-AI-Forge 开源

一键整合多款 TTS 引擎,快速搭建语音应用

Speech-AI-Forge 是一个围绕 TTS(文本转语音)生成模型构建的开源项目,提供 API 服务器和基于 Gr···

★ 1421 评分 2024-06-01
ChatTTS_colab 开源

一键部署ChatTTS,流式输出、音色抽卡、长音频轻松搞定

ChatTTS_colab 是一个基于 ChatTTS 模型的一键部署工具,主要面向文本转语音(TTS)场景。它解决了···

★ 2593 评分 2024-05-30
ChatTTS-ui 开源

本地网页一键文字转语音,还能当API用

ChatTTS-ui 是一个基于 Python 的本地网页界面,旨在为 ChatTTS 文本转语音模型提供便捷的操作入口···

★ 7662 评分 2024-05-30
ChatTTS 开源

日常对话配音自然到像真人,再也不用听机器腔

专为日常对话场景设计的生成式语音模型,能够生成自然流畅、富有表现力的对话语音。支持细粒度韵律···

★ 39871 评分 2024-05-27
xcodec 开源

让音频语言模型听懂语义,生成更准的语音和音乐

xcodec 是一个面向音频语言模型的语义编解码器,由香港科技大学等机构在 AAAI 2025 提出。它针对传···

★ 316 评分 2024-05-26
OpenMusic 开源

输入文字,一键生成专属音乐片段

OpenMusic 是一个基于 Python 的文本生成音乐(Text-to-Music)开源项目,旨在实现当前最先进的(S···

★ 634 评分 2024-05-24
FlashSpeech 开源

一段参考音频,即刻克隆音色,快速生成自然语音。

FlashSpeech 是 ACM MM 2024 发表的零样本语音合成(Zero-Shot TTS)项目,主打高效合成。它能在没···

★ 159 评分 2024-05-16
tts-azure-web 开源

用 Azure Key 一键部署,网页上直接生成自然语音

TTS Azure Web 是一个基于 Azure 文本转语音服务的网页应用,使用 TypeScript 和 Next.js 构建。它···

★ 479 评分 2024-05-09
ComfyUI-XTTS 开源

在 ComfyUI 里拖拽节点,即可克隆声音并生成多语言语音。

ComfyUI-XTTS 是一个为 ComfyUI 设计的自定义节点,集成了 Coqui AI 的 XTTS 文本转语音模块。它解···

★ 70 评分 2024-05-08
MusicGPT 开源

本地运行 LLM,用自然语言一句话生成音乐

MusicGPT 是一个基于 Rust 的本地音乐生成工具,它利用本地运行的大语言模型(LLM)理解自然语言提···

★ 1458 评分 2024-05-03
TextyMcSpeechy 开源

录点声音,就能训练出你的专属语音模型,离线跑在树莓派上。

TextyMcSpeechy 是一个用于创建 Piper 文本转语音(TTS)模型的工具,旨在让用户轻松生成任意音色的···

★ 715 评分 2024-05-01
zerovox 开源

给一段声音,立刻用那个声音说话,完全离线免费。

zerovox 是一个基于深度学习的零样本(zero-shot)实时语音合成(TTS)系统,完全离线运行,免费且···

★ 56 评分 2024-04-27
tetos 开源

一套代码接入多家 TTS 服务,告别厂商锁定

tetos 是一个为多种文本转语音(TTS)服务提供统一接口的 Python 库。它解决了开发者需要对接不同 ···

★ 277 评分 2024-04-17
tts 开源

一键接入文本转语音,快速生成自然语音输出

tts 是一个基于 TypeScript 编写的文本转语音服务,旨在提供简单、高效的语音合成能力。它解决了开···

★ 639 评分 2024-04-17
ComfyUI-GPT_SoVITS 开源

在ComfyUI里拖拽节点,就能克隆声音生成语音

ComfyUI-GPT_SoVITS 是一个将 GPT-SoVITS 集成到 ComfyUI 的自定义节点,让用户能在 ComfyUI 的可视···

★ 254 评分 2024-04-11