Bert-VITS2-MNN 是音频音乐领域的开源项目,由 Voine 开发,2025 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 162。
项目仍在小幅维护中,最近一次代码更新于 2026-09-23。Apache-2.0 许可证,可免费使用和修改,无付费版本。
它主要面向的使用场景是:手机App内离线语音助手。同类可对比的替代方案包括 VITS2-ONNX、PaddleSpeech、Coqui TTS。

把 Bert-VITS2 塞进手机,离线也能自然发声
Bert-VITS2-MNN 是一个面向 Android 移动端的离线语音合成运行时,基于阿里巴巴的 MNN 推理引擎,将 Bert-VITS2 模型轻量化部署到手机等设备上。它解决了云端 TTS 依赖网络、延迟高和隐私风险的问题,让开发者能够在本地实现高质量、低延迟的语音合成。项目核心能力包括:使用 MNN 加速推理,支持中文分词(cppjieba)和 BERT 特征提取,提供完整的 Android 应用示例,并针对移动端进行了模型优化。通过该工程,开发者可以快速集成离线 TTS 能力到自己的 App 中,实现文本到语音的转换,适用于语音助手、阅读应用、导航播报等场景。
VITS2-ONNX、PaddleSpeech、Coqui TTS
Bert-VITS2-MNN 是音频音乐领域的开源项目,由 Voine 开发,2025 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 162。
项目仍在小幅维护中,最近一次代码更新于 2026-09-23。Apache-2.0 许可证,可免费使用和修改,无付费版本。
它主要面向的使用场景是:手机App内离线语音助手。同类可对比的替代方案包括 VITS2-ONNX、PaddleSpeech、Coqui TTS。
下一篇:Thorsten-Voice
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···