voice-generation

本站收录 12 个带「voice-generation」标签的 AI 开源项目

VoiceStudioVoiceStudio 是一个开源的 AI 语音工作站,旨在成为 ElevenLabs 的替代方案。它集成了语音克隆、配音、听写、转录、有声书创作和语音工作流编★ 47,464VibeVoice-ComfyUIVibeVoice-ComfyUI 是一个将微软 VibeVoice 文本转语音模型集成到 ComfyUI 的自定义节点,让用户能在 ComfyUI 的可视化工★ 1,565alexandria-audiobookAlexandria 是一个基于 AI 的多角色有声书生成器,解决传统 TTS 只能单一音色、缺乏情感和角色区分的问题。它利用 LLM 对书籍文本进行脚本标注,★ 1,041kokoro-webKokoro Web 是一个基于 Kokoro-82M 模型的开源 AI 文本转语音(TTS)项目,提供在线演示和自托管两种使用方式。它解决了开发者快速集成高质★ 745ComfyUI-VibeVoiceComfyUI-VibeVoice 是一个为 ComfyUI 设计的自定义节点,用于集成 VibeVoice 文本转语音(TTS)引擎。它解决了在 ComfyU★ 598payload-ai为 Payload CMS 打造的强大 AI 插件,将先进的人工智能能力深度集成到内容创作与管理流程中。支持智能内容生成、优化与增强,帮助内容团队大幅提升生产效★ 555ComfyUI-VoxCPMComfyUI-VoxCPM 是一个为 ComfyUI 设计的音频生成节点,专注于高表现力的语音合成和零样本声音克隆。它解决了在 ComfyUI 工作流中集成先★ 511edumcpEDUMCP 是一个面向教育领域的开源协议,它将模型上下文协议(MCP)与教育应用相结合,旨在打通不同 AI 模型、教育软件、智能硬件和教学智能体之间的数据与能★ 156out-loudout-loud 是一个免费、开源、100% 离线的 AI 文本转语音工具,支持 macOS、Windows 和 Linux 三大平台。它基于本地优先的设计理念★ 86vibevoice-studioVibeVoice Studio 是一个基于 Python 和 FastAPI 构建的语音克隆与文本转语音(TTS)应用。它允许用户录制或上传音频来训练个性化语★ 64AllVoiceLab-MCPAllVoiceLab-MCP 是 AllVoiceLab 官方推出的模型上下文协议(MCP)服务器,旨在让 AI 助手(如 Claude、GPT 等)通过标准★ 61ttslabTTSLab 是一个本地运行的开源文本转语音(TTS)测试工具,旨在让用户零成本地在自己的电脑上轻松测试任意 TTS 模型。它解决了 TTS 模型评估和对比中需★ 53