ekho

一句话搞定中文粤语藏语语音合成,离线也能用

ekho是一个开源的文字转语音(TTS)引擎,专注于中文(普通话、粤语)及藏语等东方语言的语音合成。它解决了现有TTS引擎对中文方言和少数民族语言支持不足的问题,提供了从文本到音频的完整转换能力。核心功能包括支持粤语、普通话、藏语等多种语言,提供命令行和API接口,可生成WAV等音频格式。ekho基于语音拼接技术,通过预录语音库和韵律调整实现自然流畅的语音输出。它适合嵌入式设备、桌面应用和服务器端批量语音生成场景,轻量级设计使其在资源受限环境中也能高效运行。项目还提供了简单的音频播放和文件输出功能,方便开发者集成。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1213
维护状态 较活跃
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队hgneng
所属国家
官网地址
定价模式free
价格说明开源项目,GPL-2.0许可证,可自行部署使用,完全免费。
访问状态
是否开源是
开源协议GPL-2.0
主要语言Lex
技术栈/模型cantonese,chinese,tibetan,tts
GitHub 星标★ 1213
30天Star增速
HF 下载量
上线时间2016-04-14 00:00:00
最近更新2026-09-13 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数7

使用教程

难度:进阶 约 30 分钟 部署方式:命令行工具 5 步

⚠ 该项目 README 未提供完整安装说明,以下步骤为通用流程,请以官方文档为准。

环境要求

  • 仓库中不包含语音文件,需单独下载语音数据包
  • 需按仓库根目录的 INSTALL 文件自行编译构建
  • 语音数据可从发行包或 SourceForge 的 Ekho Voice Data 页面获取

安装与启动步骤

  1. 1克隆源码仓库

    从 GitHub 拉取 ekho 源码到本地,后续编译安装都基于该目录进行。

    git clone https://github.com/hgneng/ekho.git
  2. 2查看构建说明

    README 明确要求:构建过程遇到问题请阅读仓库根目录的 INSTALL 文件,按其步骤编译安装。

    cat INSTALL
  3. 3下载语音数据

    仓库不附带语音文件,需从发行包或 SourceForge 上 Ekho Voice Data 0.2 的下载页获取。

  4. 4替换语音文件

    若要更换普通话语音,用新语音文件整体替换 pinyin 文件夹,并删除旧的 pinyin.index 与 pinyin.voice。

    rm -f pinyin.index pinyin.voice
  5. 5重建语音索引

    重新运行 ekho,程序会依据新的语音文件重新生成 pinyin.index 和 pinyin.voice 索引文件。

如何确认成功

重新运行 ekho 后,若目录下自动生成了新的 pinyin.index 与 pinyin.voice,说明新语音库已被正确加载。

常见问题

Q:为什么克隆下来的仓库里没有语音文件?

A:README 说明语音文件不随仓库发布,需从发行包或 SourceForge 的 Ekho Voice Data 下载页单独获取。

Q:如何替换普通话的语音?

A:用新的语音文件整体替换 pinyin 文件夹,删掉 pinyin.index 和 pinyin.voice,再重新运行 ekho 即可自动重建索引。

Q:编译安装失败怎么办?

A:先阅读仓库根目录的 INSTALL 文件,里面给出了构建所需的步骤与环境说明。

Q:怎样制作自己的语音?

A:README 指向 eGuideDog 文档《如何为Ekho添加新的声音》,可按该文档流程制作新声音。

注意事项

  • README 未给出完整安装命令,实际编译步骤以仓库根目录的 INSTALL 文件为准。
  • 语音数据当前提供的版本为 0.2,下载页在 SourceForge 的 e-guidedog 项目中。
  • 删除 pinyin.index 和 pinyin.voice 后必须重新运行 ekho,索引才会基于新语音文件重建。

核心亮点

  • 支持粤语、普通话、藏语,多语言TTS在开源项目中少见
  • 轻量级引擎,适合嵌入式设备,资源占用低
  • 提供命令行和C++ API,集成简单,支持批量转换

不足之处

  • 语音库依赖预录音频,音质和自然度受限于录音质量
  • 文档和社区活跃度一般,新用户上手可能遇到问题

适用场景

  • 嵌入式设备(如智能家居)离线语音播报
  • 中文方言(粤语)内容的有声化制作
  • 服务器端批量生成语音文件用于语音导航或辅助阅读

替代项目

Festival、espeak-ng、MaryTTS

项目介绍

ekho 是音频音乐领域的开源项目,由 hgneng 开发,2016 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(1,213)位列前 30%,在音频音乐分类的 738 个项目里位列前 15%。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-13。GPL-2.0许可证,可自行部署使用,完全免费。

它主要面向的使用场景是:嵌入式设备(如智能家居)离线语音播报。同类可对比的替代方案包括 Festival、espeak-ng、MaryTTS。

上一篇:MangoByte

下一篇:Voice-Privacy-Challenge-2020

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09