tacotron2 是音频音乐领域的开源项目,由 ide8 开发,2019 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 128。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-02-13。基于BSD-3-Clause许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:个性化语音助手开发。同类可对比的替代方案包括 Coqui TTS、ESPnet-TTS、Mozilla TTS。

多说话人+情感语音合成,一键生成个性化语音
Tacotron2 是一个基于 Tacotron 2 和 Waveglow 的多说话人、情感语音合成(TTS)开源项目。它解决了传统语音合成中音色单一、缺乏情感表达的问题,支持多说话人建模和情感控制。核心能力包括:使用 Tacotron 2 将文本转换为梅尔频谱,再通过 Waveglow 声码器生成高质量语音;支持多说话人嵌入,可切换不同音色;支持情感标签,实现带情感的语音输出。项目基于 Jupyter Notebook 提供交互式演示,方便快速体验和二次开发。适合研究语音合成、构建个性化语音助手或开发有声内容生成工具。
Coqui TTS、ESPnet-TTS、Mozilla TTS
tacotron2 是音频音乐领域的开源项目,由 ide8 开发,2019 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 128。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-02-13。基于BSD-3-Clause许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:个性化语音助手开发。同类可对比的替代方案包括 Coqui TTS、ESPnet-TTS、Mozilla TTS。
上一篇:apple_airplayer
下一篇:LPC_for_TTS
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···