obs-squawk
开源
在 OBS 里直接生成实时 AI 语音,直播播报不用切软件
obs-squawk 是一个内置于 OBS Studio 的实时文本转语音(TTS)AI 引擎插件,采用 C++ 编写。它解决···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
obs-squawk
开源
在 OBS 里直接生成实时 AI 语音,直播播报不用切软件
obs-squawk 是一个内置于 OBS Studio 的实时文本转语音(TTS)AI 引擎插件,采用 C++ 编写。它解决···
praises
开源
把文字变成语音,轻松听书、配音、学外语。
Praises 是一款基于 Tauri 和 Vue 的跨平台文本转语音(TTS)桌面工具,主要解决用户快速将文字转换···
audiotoken
开源
极速音频转令牌,让音频生成快人一步
audiotoken 是一个专注于音频令牌化的开源项目,旨在以最快的方式将音频信号转换为离散的令牌序列,···
TTSlist
开源
10000条ChatTTS音色随便挑,告别音色抽卡烦恼
TTSlist 是一个为 ChatTTS 文本转语音模型打造的音色库,收录了 10000 条预生成的音色样本,解决用···
ChatTTS-OpenVoice
开源
上传10秒音频,克隆你的专属ChatTTS音色
ChatTTS-OpenVoice 是一个将 ChatTTS 与 OpenVoice 融合的开源语音克隆工具。它解决的核心问题是:···
HebTTS
开源
跳过元音预测,直接让AI用希伯来语开口说话
HebTTS 是论文《A Language Modeling Approach to Diacritic-Free Hebrew TTS》的官方实现,旨在解···
MARS5-TTS
开源
几秒音频克隆音色,生成富有情感的语音
MARS5-TTS 是 CAMB.AI 开源的语音合成模型,专注于高表现力的文本转语音和声音克隆。它解决的核心问···
ControlSpeech
开源
几秒克隆音色,同时随心控制说话风格
ControlSpeech 是一个基于 ACL 2025 论文的零样本语音克隆与语言风格控制开源项目。它解决的核心问···
chattts-seed-example
开源
试听 ChatTTS 各音色,快速挑中你喜欢的 seed
chattts-seed-example 是一个面向 ChatTTS 用户的音色种子示例库。ChatTTS 是一个文本转语音模型,···
Speech-AI-Forge
开源
一键整合多款 TTS 引擎,快速搭建语音应用
Speech-AI-Forge 是一个围绕 TTS(文本转语音)生成模型构建的开源项目,提供 API 服务器和基于 Gr···
ChatTTS_colab
开源
一键部署ChatTTS,流式输出、音色抽卡、长音频轻松搞定
ChatTTS_colab 是一个基于 ChatTTS 模型的一键部署工具,主要面向文本转语音(TTS)场景。它解决了···
ChatTTS-ui
开源
本地网页一键文字转语音,还能当API用
ChatTTS-ui 是一个基于 Python 的本地网页界面,旨在为 ChatTTS 文本转语音模型提供便捷的操作入口···
ChatTTS
开源
日常对话配音自然到像真人,再也不用听机器腔
专为日常对话场景设计的生成式语音模型,能够生成自然流畅、富有表现力的对话语音。支持细粒度韵律···
xcodec
开源
让音频语言模型听懂语义,生成更准的语音和音乐
xcodec 是一个面向音频语言模型的语义编解码器,由香港科技大学等机构在 AAAI 2025 提出。它针对传···
OpenMusic
开源
输入文字,一键生成专属音乐片段
OpenMusic 是一个基于 Python 的文本生成音乐(Text-to-Music)开源项目,旨在实现当前最先进的(S···
FlashSpeech
开源
一段参考音频,即刻克隆音色,快速生成自然语音。
FlashSpeech 是 ACM MM 2024 发表的零样本语音合成(Zero-Shot TTS)项目,主打高效合成。它能在没···
tts-azure-web
开源
用 Azure Key 一键部署,网页上直接生成自然语音
TTS Azure Web 是一个基于 Azure 文本转语音服务的网页应用,使用 TypeScript 和 Next.js 构建。它···
ComfyUI-XTTS
开源
在 ComfyUI 里拖拽节点,即可克隆声音并生成多语言语音。
ComfyUI-XTTS 是一个为 ComfyUI 设计的自定义节点,集成了 Coqui AI 的 XTTS 文本转语音模块。它解···
MusicGPT
开源
本地运行 LLM,用自然语言一句话生成音乐
MusicGPT 是一个基于 Rust 的本地音乐生成工具,它利用本地运行的大语言模型(LLM)理解自然语言提···
TextyMcSpeechy
开源
录点声音,就能训练出你的专属语音模型,离线跑在树莓派上。
TextyMcSpeechy 是一个用于创建 Piper 文本转语音(TTS)模型的工具,旨在让用户轻松生成任意音色的···
zerovox
开源
给一段声音,立刻用那个声音说话,完全离线免费。
zerovox 是一个基于深度学习的零样本(zero-shot)实时语音合成(TTS)系统,完全离线运行,免费且···
tetos
开源
一套代码接入多家 TTS 服务,告别厂商锁定
tetos 是一个为多种文本转语音(TTS)服务提供统一接口的 Python 库。它解决了开发者需要对接不同 ···
tts
开源
一键接入文本转语音,快速生成自然语音输出
tts 是一个基于 TypeScript 编写的文本转语音服务,旨在提供简单、高效的语音合成能力。它解决了开···
ComfyUI-GPT_SoVITS
开源
在ComfyUI里拖拽节点,就能克隆声音生成语音
ComfyUI-GPT_SoVITS 是一个将 GPT-SoVITS 集成到 ComfyUI 的自定义节点,让用户能在 ComfyUI 的可视···