Speech 是开发框架领域的开源项目,由 NVIDIA-NeMo 开发,2019 年首次发布。
在全站 13,090 个收录项目中,它的 GitHub 星标数(18,490)位列前 3%,在开发框架分类的 803 个项目里位列前 3%。
近 41 天,它的 GitHub 星标从 18,112 增加到 18,490,净增 378。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。Apache-2.0许可,完全免费,可自行部署使用。
它主要面向的使用场景是:学术研究:快速复现语音识别/合成论文实验。同类可对比的替代方案包括 ESPnet、NeMo、Coqui TTS。




