音频音乐

汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。

共收录 738 个开源项目

ttslab 开源

本地免费测任意TTS模型,快速对比效果

TTSLab 是一个本地运行的开源文本转语音(TTS)测试工具,旨在让用户零成本地在自己的电脑上轻松测···

★ 53 评分 2026-02-13
MioTTS-Inference 开源

轻量快速的 LLM 语音合成推理服务,支持声音克隆,即插即用。

MioTTS-Inference 是 MioTTS 的推理服务器,MioTTS 是一个基于大语言模型的轻量级、快速的文本转语···

★ 204 评分 2026-02-10
VODER 开源

一句话克隆你的声音,轻松实现语音转换与合成

VODER(Voice Operation and Design Engine with Reproduction)是一个基于Python的语音操作与设计···

★ 516 评分 2026-02-09
MOSS-TTS 开源

一站式生成高保真语音、对话、音效,支持实时流式输出

MOSS-TTS 是由 MOSI.AI 和 OpenMOSS 团队开发的开源语音与声音生成模型家族,专注于高保真、高表现···

★ 4141 评分 2026-02-07
AstraTTS 开源

本地化低延迟流式TTS,支持自定义音色和中英混说

AstraTTS 是一个基于 ONNX Runtime 的跨平台高性能文本转语音(TTS)合成方案,主要面向需要低延迟···

★ 97 评分 2026-02-05
ace-step-ui 开源

本地无限量生成音乐,免费白嫖 Suno 同款

开源免费的 ACE-Step 1.5 AI 音乐生成专业界面,被誉为 Suno 的最佳开源替代。本地运行、无限生成、···

★ 4977 评分 2026-02-04
alexandria-audiobook 开源

一句话把小说变成多角色有声书,克隆声音、逐行控风格

Alexandria 是一个基于 AI 的多角色有声书生成器,解决传统 TTS 只能单一音色、缺乏情感和角色区分···

★ 1035 评分 2026-02-03
MOSS-Audio-Tokenizer 开源

把音频变成 token,让大模型能听会说

MOSS-Audio-Tokenizer 是一个基于因果 Transformer 架构(CAT)的音频分词器,旨在将连续音频信号转···

★ 258 评分 2026-02-03
vox 开源

用 Rust 打造低延迟语音转写与合成工具包

vox 是一个用 Rust 编写的通用 AI 工具包,专注于高性能的语音转文字(STT)和文字转语音(TTS)处···

★ 160 评分 2026-02-02
qwen-tts2api 开源

把通义千问 TTS 包装成 OpenAI 接口,一行代码切换语音服务

qwen-tts2api 是一个将通义千问的 TTS(文本转语音)能力封装成 OpenAI 兼容的 Speech API 的轻量级···

★ 87 评分 2026-02-02
out-loud 开源

离线也能生成自然语音,跨平台免费使用

out-loud 是一个免费、开源、100% 离线的 AI 文本转语音工具,支持 macOS、Windows 和 Linux 三大平···

★ 82 评分 2026-01-31
qwen3-tts-rs 开源

用 Rust 原生跑通 Qwen3-TTS,轻量部署高性能语音合成

qwen3-tts-rs 是一个用 Rust 实现的 Qwen3-TTS 语音合成引擎,基于 Candle 机器学习框架,将通义千···

★ 147 评分 2026-01-30
qwen3-tts-apple-silicon 开源

在 Mac 上离线跑通 Qwen3-TTS,克隆音色、设计声音,一键生成。

这是一个在苹果自研芯片 Mac 上本地运行 Qwen3-TTS 文本转语音模型的工具,支持 M1/M2/M3/M4 全系列···

★ 567 评分 2026-01-28
MimikaStudio 开源

本地优先的 macOS 有声书转换与管理工具,支持 AI 代理自动化处理。

MimikaStudio 是一款面向 macOS(Apple Silicon)的本地优先应用,专注于音频书转换与管理,并集成···

★ 741 评分 2026-01-26
ComfyUI-FL-Qwen3TTS 开源

在ComfyUI里一键把文字变语音,还能克隆音色

ComfyUI-FL-Qwen3TTS 是把阿里 Qwen3-TTS 语音合成能力接入 ComfyUI 的节点插件,让用户在 ComfyUI···

★ 152 评分 2026-01-26
voicebox 开源

一站式克隆、转写、合成声音,打造你的 AI 语音工作室

voicebox 是一个开源的 AI 语音工作室,旨在提供一站式的声音克隆、语音转写和语音合成能力。它解决···

★ 55763 评分 2026-01-25
zai-tts 开源

把智谱 TTS 变成 OpenAI 接口,免费克隆音色,无缝切换

zai-tts 是一个将智谱 AI 的 TTS(文本转语音)服务转换为 OpenAI 兼容 API 的轻量级开源项目。它解···

★ 194 评分 2026-01-23
TalkifyTTS 开源

让 Android 应用秒变 AI 播音员,多模型任选

TalkifyTTS 是一款由云端大模型驱动的 Android 语音合成(TTS)引擎,旨在为 Android 应用提供高质···

★ 350 评分 2026-01-23
ComfyUI-Qwen3-TTS 开源

在 ComfyUI 里拖拽节点,即可用 Qwen3 模型合成、克隆和定制语音。

ComfyUI-Qwen3-TTS 是一个将阿里通义千问团队开源的 Qwen3-TTS 模型集成到 ComfyUI 中的自定义节点···

★ 303 评分 2026-01-22
Unitale 开源

浏览器里一键把剧本变成带音效和配图的有声书

Unitale 是一款基于 IndexTTS 和 Qwen3TTS 的 AI 有声书制作工具,旨在解决从文本到成品有声书的全···

★ 224 评分 2026-01-19
magda-core 开源

用代码和AI驱动音乐制作,让DAW自动化飞起来

magda-core 是一个基于 C++20 和 JUCE 框架构建的数字音频工作站(DAW)核心库,专为自动化、音频变···

★ 218 评分 2026-01-17
awesome-suno-prompts 开源

千条专业提示词,一键生成榜单级歌曲

这是一个精选的 Suno AI 音乐提示词合集,收录了超过 1000 条专业级风格提示词,帮助用户生成接近榜···

★ 89 评分 2026-01-16
Novery 开源

多源聚合+离线朗读,打造你的专属小说阅读器

Novery 是一款现代化的安卓小说阅读器,专注于多源内容聚合与离线阅读体验。它解决了小说爱好者需要···

★ 55 评分 2026-01-14
soprano-factory 开源

训练你的 2000 倍实时超快语音合成模型

Soprano-Factory 是一个用于训练超高速文本转语音(TTS)模型的开源项目,其核心目标是让开发者能够···

★ 261 评分 2026-01-13