ttslab
开源
本地免费测任意TTS模型,快速对比效果
TTSLab 是一个本地运行的开源文本转语音(TTS)测试工具,旨在让用户零成本地在自己的电脑上轻松测···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
ttslab
开源
本地免费测任意TTS模型,快速对比效果
TTSLab 是一个本地运行的开源文本转语音(TTS)测试工具,旨在让用户零成本地在自己的电脑上轻松测···
MioTTS-Inference
开源
轻量快速的 LLM 语音合成推理服务,支持声音克隆,即插即用。
MioTTS-Inference 是 MioTTS 的推理服务器,MioTTS 是一个基于大语言模型的轻量级、快速的文本转语···
VODER
开源
一句话克隆你的声音,轻松实现语音转换与合成
VODER(Voice Operation and Design Engine with Reproduction)是一个基于Python的语音操作与设计···
MOSS-TTS
开源
一站式生成高保真语音、对话、音效,支持实时流式输出
MOSS-TTS 是由 MOSI.AI 和 OpenMOSS 团队开发的开源语音与声音生成模型家族,专注于高保真、高表现···
AstraTTS
开源
本地化低延迟流式TTS,支持自定义音色和中英混说
AstraTTS 是一个基于 ONNX Runtime 的跨平台高性能文本转语音(TTS)合成方案,主要面向需要低延迟···
ace-step-ui
开源
本地无限量生成音乐,免费白嫖 Suno 同款
开源免费的 ACE-Step 1.5 AI 音乐生成专业界面,被誉为 Suno 的最佳开源替代。本地运行、无限生成、···
alexandria-audiobook
开源
一句话把小说变成多角色有声书,克隆声音、逐行控风格
Alexandria 是一个基于 AI 的多角色有声书生成器,解决传统 TTS 只能单一音色、缺乏情感和角色区分···
MOSS-Audio-Tokenizer
开源
把音频变成 token,让大模型能听会说
MOSS-Audio-Tokenizer 是一个基于因果 Transformer 架构(CAT)的音频分词器,旨在将连续音频信号转···
vox
开源
用 Rust 打造低延迟语音转写与合成工具包
vox 是一个用 Rust 编写的通用 AI 工具包,专注于高性能的语音转文字(STT)和文字转语音(TTS)处···
qwen-tts2api
开源
把通义千问 TTS 包装成 OpenAI 接口,一行代码切换语音服务
qwen-tts2api 是一个将通义千问的 TTS(文本转语音)能力封装成 OpenAI 兼容的 Speech API 的轻量级···
out-loud
开源
离线也能生成自然语音,跨平台免费使用
out-loud 是一个免费、开源、100% 离线的 AI 文本转语音工具,支持 macOS、Windows 和 Linux 三大平···
qwen3-tts-rs
开源
用 Rust 原生跑通 Qwen3-TTS,轻量部署高性能语音合成
qwen3-tts-rs 是一个用 Rust 实现的 Qwen3-TTS 语音合成引擎,基于 Candle 机器学习框架,将通义千···
在 Mac 上离线跑通 Qwen3-TTS,克隆音色、设计声音,一键生成。
这是一个在苹果自研芯片 Mac 上本地运行 Qwen3-TTS 文本转语音模型的工具,支持 M1/M2/M3/M4 全系列···
MimikaStudio
开源
本地优先的 macOS 有声书转换与管理工具,支持 AI 代理自动化处理。
MimikaStudio 是一款面向 macOS(Apple Silicon)的本地优先应用,专注于音频书转换与管理,并集成···
ComfyUI-FL-Qwen3TTS
开源
在ComfyUI里一键把文字变语音,还能克隆音色
ComfyUI-FL-Qwen3TTS 是把阿里 Qwen3-TTS 语音合成能力接入 ComfyUI 的节点插件,让用户在 ComfyUI···
voicebox
开源
一站式克隆、转写、合成声音,打造你的 AI 语音工作室
voicebox 是一个开源的 AI 语音工作室,旨在提供一站式的声音克隆、语音转写和语音合成能力。它解决···
zai-tts
开源
把智谱 TTS 变成 OpenAI 接口,免费克隆音色,无缝切换
zai-tts 是一个将智谱 AI 的 TTS(文本转语音)服务转换为 OpenAI 兼容 API 的轻量级开源项目。它解···
TalkifyTTS
开源
让 Android 应用秒变 AI 播音员,多模型任选
TalkifyTTS 是一款由云端大模型驱动的 Android 语音合成(TTS)引擎,旨在为 Android 应用提供高质···
ComfyUI-Qwen3-TTS
开源
在 ComfyUI 里拖拽节点,即可用 Qwen3 模型合成、克隆和定制语音。
ComfyUI-Qwen3-TTS 是一个将阿里通义千问团队开源的 Qwen3-TTS 模型集成到 ComfyUI 中的自定义节点···
Unitale
开源
浏览器里一键把剧本变成带音效和配图的有声书
Unitale 是一款基于 IndexTTS 和 Qwen3TTS 的 AI 有声书制作工具,旨在解决从文本到成品有声书的全···
magda-core
开源
用代码和AI驱动音乐制作,让DAW自动化飞起来
magda-core 是一个基于 C++20 和 JUCE 框架构建的数字音频工作站(DAW)核心库,专为自动化、音频变···
awesome-suno-prompts
开源
千条专业提示词,一键生成榜单级歌曲
这是一个精选的 Suno AI 音乐提示词合集,收录了超过 1000 条专业级风格提示词,帮助用户生成接近榜···
Novery
开源
多源聚合+离线朗读,打造你的专属小说阅读器
Novery 是一款现代化的安卓小说阅读器,专注于多源内容聚合与离线阅读体验。它解决了小说爱好者需要···
soprano-factory
开源
训练你的 2000 倍实时超快语音合成模型
Soprano-Factory 是一个用于训练超高速文本转语音(TTS)模型的开源项目,其核心目标是让开发者能够···