MTTS 是音频音乐领域的开源项目,由 makerjackie 开发,2017 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 284。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-05-31。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:中文语音合成系统前端模块的参考实现。同类可对比的替代方案包括 espnet-tts、MeloTTS、ChatTTS。

把中文文本变成语音合成可用的声学特征,一步到位
MTTS 是一个面向普通话/中文的文本转语音(TTS)前端演示项目,主要聚焦于中文语音合成的前端处理环节。它解决了中文 TTS 中文本规范化、韵律预测、多音字消歧等前端难题,将原始文本转换为适合后端声学模型和声码器使用的语言特征序列。项目基于 Python 实现,提供了一套可运行的演示流程,展示了从中文文本输入到音素/韵律特征输出的完整处理管线。其核心能力包括中文分词、拼音转换、多音字选择、韵律边界预测等,并支持自定义词典和规则扩展。作为一个早期演示项目,MTTS 代码结构清晰,适合学习中文 TTS 前端技术原理,也可作为二次开发的基础框架。
espnet-tts、MeloTTS、ChatTTS
MTTS 是音频音乐领域的开源项目,由 makerjackie 开发,2017 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 284。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-05-31。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:中文语音合成系统前端模块的参考实现。同类可对比的替代方案包括 espnet-tts、MeloTTS、ChatTTS。
上一篇:mandarin-tts
下一篇:zhtts
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···