kugelaudio-open 是音频音乐领域的开源项目,由 Kugelaudio 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 757 个项目,GitHub 星标数为 273。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-23。开源免费,需自行部署。
它主要面向的使用场景是:为欧洲小语种视频或播客生成配音。同类可对比的替代方案包括 Coqui TTS、XTTS。

欧洲语言文本转语音,还能克隆你的音色
kugelaudio-open 是一个面向欧洲语言的开源文本转语音(TTS)项目,用 Python 实现,支持语音克隆。它想解决的问题是:主流高质量 TTS 多集中在英语或中文,欧洲小语种(如德语、法语、西班牙语、意大利语等)的合成与个性化音色资源稀缺。项目提供从文本到语音的推理能力,并允许用户用少量参考音频克隆目标说话人音色,从而生成带指定音色的语音。核心能力包括多语言 TTS 推理、基于参考音频的音色克隆,以及可本地部署的 Python 接口,方便集成到配音、有声内容、辅助阅读等流程中。项目目前处于早期阶段,星标约 273,适合想研究或自建欧洲语言语音合成管线的开发者试用与二次开发。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
Coqui TTS、XTTS
kugelaudio-open 是音频音乐领域的开源项目,由 Kugelaudio 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 757 个项目,GitHub 星标数为 273。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-23。开源免费,需自行部署。
它主要面向的使用场景是:为欧洲小语种视频或播客生成配音。同类可对比的替代方案包括 Coqui TTS、XTTS。
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···