音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

csm-voice-cloning 开源

上传几秒音频,快速克隆音色并生成自然语音

csm-voice-cloning 是一个基于 Sesame CSM 1B 模型的语音克隆开源项目,旨在让开发者能够通过少量参···

★ 339 评分 2025-03-14
Orpheus-TTS 开源

让AI说话像真人,实时合成高表现力语音

Orpheus-TTS 是一个开源文本转语音(TTS)项目,旨在生成接近真人发音的语音。它基于大型语言模型(···

★ 6347 评分 2025-03-08
LLMVoX 开源

让任意LLM秒变语音助手,流式对话零延迟

LLMVoX 是一个将任意大型语言模型(LLM)转换为支持流式语音对话的端到端系统。它解决了传统语音助···

★ 312 评分 2025-03-06
easytts 开源

上传小说,一键生成多人有声书,自动分角色朗读。

EasyTTS 是一个致力于简化 TTS(文本转语音)前端流程的开源项目,主要面向有声小说制作场景。它通···

★ 149 评分 2025-03-05
runandread-audiobook 开源

在家用AI把电子书变成有声书,省钱又省心

这是一个开源项目,旨在让用户在家就能制作高质量的AI配音有声书。它通过整合多种TTS模型(如Zonos···

★ 63 评分 2025-03-02
awesome-music-programming 开源

一站式找齐音乐编程工具,省去全网搜索时间

这是一个精心整理的音频与音乐编程资源清单,收录了音乐编程语言、库、框架和工具。它解决了音乐开···

★ 149 评分 2025-02-17
flux-generator 开源

在 Mac 上本地生成图像和音乐,无需云端

flux-generator 是一个专为 Apple Silicon 设计的本地图像与音乐生成工具,基于 Python 构建,集成···

★ 79 评分 2025-02-14
kokoro-web 开源

浏览器里跑AI语音合成,离线免费还能定制声音

kokoro-web 是一个基于机器学习的语音合成项目,完全在浏览器中运行,无需服务器。它利用 WebAssem···

★ 179 评分 2025-02-14
kokoro-web 开源

免费自托管AI语音合成,OpenAI接口一键接入

Kokoro Web 是一个基于 Kokoro-82M 模型的开源 AI 文本转语音(TTS)项目,提供在线演示和自托管两···

★ 740 评分 2025-02-09
nanospeech 开源

轻量可改的 TTS 系统,快速上手自定义语音合成

nanospeech 是一个极简、可自由修改的文本转语音(TTS)系统,基于 PyTorch 和 MLX 构建。它旨在解···

★ 190 评分 2025-02-09
CosyVoice2-Ex 开源

3秒复刻音色,自然语言控声音,开箱即用的语音合成增强包

CosyVoice2-Ex 是基于阿里开源 CosyVoice2 的增强扩展项目,旨在解决原版在音色定制和部署体验上的···

★ 197 评分 2025-02-08
index-tts 开源

上传几秒语音,立刻克隆你的声音,随便说哪种语言都行

index-tts 是一个面向工业级应用的零样本文本转语音(TTS)系统,核心能力是仅凭几秒参考音频即可克···

★ 24190 评分 2025-02-06
tts-samples 开源

下载现成多语言TTS样本,快速试听选型

这是一个提供文本转语音(TTS)音频样本的仓库,所有样本均为MP3格式,覆盖多种语言,由微软Edge T···

★ 107 评分 2025-01-31
KokoroSharp 开源

在 .NET 项目中一行代码集成离线多语言语音合成

KokoroSharp 是一个基于 C# 和 ONNX Runtime 的本地 TTS(文本转语音)推理引擎,专注于为 .NET 开···

★ 245 评分 2025-01-30
kokoro-ios 开源

在苹果设备上离线生成自然语音,保护隐私且快速。

kokoro-ios 是一个基于 Kokoro TTS 引擎的 iOS 和 macOS 原生文本转语音应用,使用 Swift 和 Swift···

★ 290 评分 2025-01-26
Kokoro-82M-Android 开源

在 Android 上快速跑通 Kokoro 文本转语音 demo

Kokoro-82M-Android 是一个极简的 Android 演示应用,旨在展示 Kokoro-TTS 在移动端的运行能力。它···

★ 66 评分 2025-01-25
YuE 开源

写句歌词就出一整首歌,人声伴奏全都有

YuE 是开源的全曲目音乐生成基础模型,功能类似 Suno.ai 但完全开放。支持生成带人声的完整歌曲,涵···

★ 10339 评分 2025-01-23
openreader 开源

把电子书变成有声书,边听边看自动高亮

openreader 是一个开源的文档朗读服务器,旨在将电子书和文档转换为高质量的语音播放体验。它支持 ···

★ 515 评分 2025-01-18
Kokoro-TTS-windows 开源

解压即用,离线高质语音合成,小白也能玩转 TTS

Kokoro-TTS-windows 是一个面向 Windows 平台的 Kokoro 文本转语音(TTS)工具,主打零配置、开箱即···

★ 102 评分 2025-01-18
ComfyUI-EdgeTTS 开源

在 ComfyUI 里一键把文字变成自然语音,轻松加配音。

ComfyUI-EdgeTTS 是一个为 ComfyUI 设计的文本转语音节点,基于微软 Edge TTS 服务,可将文本快速转···

★ 78 评分 2025-01-16
kokoro-tts 开源

命令行一键把电子书和PDF变成有声书

kokoro-tts 是一个基于 Kokoro 模型的命令行文本转语音工具,主要解决用户快速将文本、电子书(EPU···

★ 1894 评分 2025-01-14
audiblez 开源

把电子书一键变成有声书,通勤路上用耳朵读书

audiblez 是一个将电子书转换为有声书的开源工具,主要解决用户希望“听书”而非“看书”的需求。它···

★ 8665 评分 2025-01-14
Kokoros 开源

用 Rust 实现极速实时高质量语音合成

Kokoros 是一个用 Rust 语言实现的 Kokoro TTS 引擎,基于 Hugging Face 上的 Kokoro-82M 模型。它···

★ 827 评分 2025-01-12
MIDI-GPT 开源

用 GPT-2 生成可控多轨 MIDI 音乐,让 AI 作曲更灵活。

MIDI-GPT 是一个基于 GPT-2 架构的符号音乐生成模型,专注于可控的多轨音乐创作。它解决的核心问题···

★ 100 评分 2025-01-10