VODER 是音频音乐领域的开源项目,由 HAKORADev 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 516。
项目仍在小幅维护中,最近一次代码更新于 2026-09-23。AGPL-3.0许可,可免费使用和部署。
它主要面向的使用场景是:个性化语音助手开发。同类可对比的替代方案包括 Coqui TTS、Resemble AI、Voice-Cloning-App。

一句话克隆你的声音,轻松实现语音转换与合成
VODER(Voice Operation and Design Engine with Reproduction)是一个基于Python的语音操作与设计引擎,专注于语音克隆、语音转换和文本转语音(TTS)等音频生成任务。它旨在解决语音合成中声音复现与个性化设计的问题,提供从文本到语音、从源声音到目标声音的转换能力。核心能力包括语音克隆(通过少量样本复制音色)、语音转换(改变说话人身份而不改变内容)、以及音乐生成(结合音乐与语音处理)。项目采用模块化设计,支持灵活配置,适合研究人员和开发者快速实验与集成。目前处于早期阶段,星标数265,但技术栈覆盖了当前语音生成领域的主流方向,具有潜在的应用价值。
Coqui TTS、Resemble AI、Voice-Cloning-App
VODER 是音频音乐领域的开源项目,由 HAKORADev 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 516。
项目仍在小幅维护中,最近一次代码更新于 2026-09-23。AGPL-3.0许可,可免费使用和部署。
它主要面向的使用场景是:个性化语音助手开发。同类可对比的替代方案包括 Coqui TTS、Resemble AI、Voice-Cloning-App。
上一篇:audio.cpp-webui
下一篇:ai-dj
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···