wyoming-piper-gpu
开源
给 Home Assistant 的 Piper 语音装上 GPU 加速,秒级响应
wyoming-piper-gpu 是一个为 Home Assistant 提供 GPU 加速的 Piper 文本转语音(TTS)服务的 Dock···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
共收录 738 个开源项目
wyoming-piper-gpu
开源
给 Home Assistant 的 Piper 语音装上 GPU 加速,秒级响应
wyoming-piper-gpu 是一个为 Home Assistant 提供 GPU 加速的 Piper 文本转语音(TTS)服务的 Dock···
ComfyUI-audio
开源
在 ComfyUI 里拖拽节点,轻松生成音乐和语音
ComfyUI-audio 是一个为 ComfyUI 平台开发的音频生成工具集,旨在将音乐生成、文本转语音等音频能力···
OpenVoice
开源
给一段录音,立刻复刻出同款声音,谁都能当配音员
由 MIT 与 MyShell 联合打造的开源音频基础模型,支持即时声音克隆。仅需一段参考音频即可克隆任意···
OpenAI-Audiobook-Generator
开源
输入文本,一键生成有声书音频
这是一个基于网页的文本转音频工具,专注于生成有声书。它利用OpenAI的语音合成能力,将用户提供的···
tortoise.cpp
开源
在本地 CPU 上快速跑通 tortoise-tts,无需 GPU 也能语音合成。
tortoise.cpp 是 tortoise-tts 的 ggml (C++) 重新实现,旨在将高质量文本转语音模型本地化运行。它···
xtts2-ui
开源
上传10秒语音,即刻克隆声音并生成任意文本语音
xtts2-ui 是一个为 Coqui XTTS-2 模型打造的图形化界面工具,让用户仅需 10 秒的语音样本即可完成文···
obsidian-aloud-tts
开源
在 Obsidian 里选中文字就能听,边记边听提效率
obsidian-aloud-tts 是一个 Obsidian 的文本转语音(TTS)插件,用 TypeScript 编写,结合 React 和···
xtts-api-server
开源
一键部署XTTSv2,快速实现多语言语音合成与克隆
xtts-api-server 是一个基于 FastAPI 的轻量级服务端,用于部署和运行 Coqui AI 的 XTTSv2 文本转语···
OpenAI-Text-To-Speech-for-Unity
开源
在Unity中一键调用OpenAI语音合成,让应用开口说话
这是一个Unity插件,将OpenAI的文本转语音(TTS)能力集成到Unity引擎中。它解决了Unity开发者需要···
clone-voice
开源
上传声音样本,即刻克隆音色生成语音
clone-voice 是一个带 Web 界面的声音克隆工具,使用 Python 编写。它允许用户用自己的音色或任意声···
text_generation_webui_xtts
开源
给文本生成界面加上XTTSv2语音输出,让AI开口说话
text_generation_webui_xtts 是一个为 oobabooga text-generation-webui 设计的 XTTSv2 扩展插件。···
VoxNovel
开源
一键把电子书变成多人配音的有声书
VoxNovel 是一个将电子书转换为有声书的开源工具,核心特点是能为书中每个角色分配不同的配音演员,···
Amphion
开源
一站式音频生成工具箱,快速上手语音、音乐与歌声合成
Amphion 是一个面向音频、音乐和语音生成的开源工具包,旨在支持可复现研究,并帮助初级研究者和工···
mustango
开源
用自然语言精准控制音乐生成,让每句描述都变成旋律。
Mustango是一个面向可控文本生成音乐的开源模型,旨在解决现有文本到音乐生成中控制能力弱、语义对···
OpenAI-TTS-Gradio
开源
拖拽文本,一键生成 OpenAI 语音,无需写代码。
OpenAI-TTS-Gradio 是一个基于 Gradio 构建的轻量级 Web 界面,用于调用 OpenAI 的文本转语音(TTS···
pflowtts_pytorch
开源
用 flow matching 快速生成自然语音,复现 NVIDIA 论文效果
P-Flow TTS 的非官方 PyTorch 实现,基于 NVIDIA 的论文,采用 flow matching 技术进行文本到语音合···
openai_tts
开源
让 Home Assistant 用上 OpenAI 高质量语音,播报更自然
这是一个为 Home Assistant 打造的自定义文本转语音(TTS)组件,利用 OpenAI 的语音合成引擎或任何···
EmotiVoice
开源
打几个字就能让配音带情绪,开心难过随你指挥
网易有道开源的多音色、提示词可控 TTS 引擎,通过文本提示即可控制合成语音的情感与风格。支持多种···
open-audio
开源
输入文字,一键生成自然语音并下载
Open-Audio 是一个基于 OpenAI 文本转语音(TTS)模型的 Web 应用,旨在将文字快速转换为自然流畅的···
ospeak
开源
终端里一句话,文本秒变语音文件
ospeak 是一个基于 Python 的 CLI 工具,用于调用 OpenAI 的文本转语音(TTS)API。它解决了开发者···
CapCut-TTS
开源
免费把剪映 TTS 变成 API,快速接入你的应用
CapCut-TTS 是一个基于 TypeScript 开发的轻量级 API 封装工具,旨在将剪映(CapCut)内置的文本转···
awesome-ai-music-generation
开源
一网打尽AI音乐生成工具,快速找到你需要的创作利器。
这是一个精选的AI音乐生成资源与项目合集,旨在整理和展示利用机器学习算法进行音乐创作的开源工具···
lobe-tts
开源
一行代码接入多平台语音合成与识别,服务端浏览器通吃。
Lobe TTS 是一个基于 TypeScript 的高质量、可靠的语音合成(TTS)与语音识别(STT)库,专为服务端···
UniCATS-CTX-txt2vec
开源
用扩散模型生成自然语音,让 TTS 更有表现力
UniCATS-CTX-txt2vec 是 AAAI 2024 论文中 UniCATS 语音合成系统的声学模型组件,基于 VQ-Diffusio···