bark.cpp 是音频音乐领域的开源项目,由 PABannier 开发,2023 年首次发布。
在全站 13,635 个收录项目中,它的 GitHub 星标数(870)位列前 30%,在音频音乐分类中处于中上游。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2024-11-16。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:嵌入式设备或边缘计算环境下的离线语音合成。同类可对比的替代方案包括 whisper.cpp、llama.cpp、piper。

用C++跑Bark模型,轻量快速本地生成语音
bark.cpp 是一个将 Suno AI 的 Bark 文本转语音模型用 C/C++ 重新实现的开源项目,基于 ggml 推理引擎,无需 Python 环境和深度学习框架即可运行。它解决了 Bark 原始实现依赖 PyTorch、部署笨重、推理速度慢的问题,通过纯 C/C++ 实现实现了跨平台、轻量化的本地 TTS。核心能力包括:支持多种语言和语音克隆、可生成非语言音频(如音乐、笑声)、支持 CPU/GPU 推理,并提供简单的命令行接口。项目处于早期阶段,但已具备基本的文本转语音功能,适合在资源受限或需要嵌入式部署的场景中使用。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
—
whisper.cpp、llama.cpp、piper
bark.cpp 是音频音乐领域的开源项目,由 PABannier 开发,2023 年首次发布。
在全站 13,635 个收录项目中,它的 GitHub 星标数(870)位列前 30%,在音频音乐分类中处于中上游。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2024-11-16。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:嵌入式设备或边缘计算环境下的离线语音合成。同类可对比的替代方案包括 whisper.cpp、llama.cpp、piper。
上一篇:diffwave
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
VoiceStudio
开源
开源语音全能工作站,克隆、配音、转录一站式搞定
VoiceStudio is the open-source, fully-local ElevenLabs alternative — voice cloning,···
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···