Pandrator 是音频音乐领域的开源项目,由 lukaszliniewicz 开发,2024 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 627。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。完全免费开源,本地部署,无付费版本。
它主要面向的使用场景是:将电子书转换为有声书,方便通勤或睡前听书。同类可对比的替代方案包括 Coqui TTS、OpenAudio、Kokoro TTS。

把 PDF 和视频一键变成带克隆声音的有声书和译制片
Pandrator 是一款免费开源的本地化音频生成工具,主要将 PDF 和 EPUB 电子书转换为有声书,也能将字幕或视频进行配音(含翻译),并支持更多音频处理功能。它完全依赖本地模型运行,无需联网,保护隐私。核心能力包括:文本转语音(TTS)、即时声音克隆、基于 RVC 的音色增强、XTTS 微调,以及通过 LLM 进行文本处理(如翻译、润色)。项目提供图形界面(GUI)、一键安装器和一体化包,旨在降低使用门槛,让非技术用户也能轻松创建高质量有声内容。Pandrator 集成了多种开源 TTS 引擎(如 Kokoro、Silero),支持多语言,适合个人创作者、教育工作者和内容本地化团队使用。目前项目处于早期阶段,但功能完整,社区活跃。
Coqui TTS、OpenAudio、Kokoro TTS
Pandrator 是音频音乐领域的开源项目,由 lukaszliniewicz 开发,2024 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 627。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。完全免费开源,本地部署,无付费版本。
它主要面向的使用场景是:将电子书转换为有声书,方便通勤或睡前听书。同类可对比的替代方案包括 Coqui TTS、OpenAudio、Kokoro TTS。
上一篇:tiktok-voice
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···