Pandrator

把 PDF 和视频一键变成带克隆声音的有声书和译制片

Pandrator 是一款免费开源的本地化音频生成工具,主要将 PDF 和 EPUB 电子书转换为有声书,也能将字幕或视频进行配音(含翻译),并支持更多音频处理功能。它完全依赖本地模型运行,无需联网,保护隐私。核心能力包括:文本转语音(TTS)、即时声音克隆、基于 RVC 的音色增强、XTTS 微调,以及通过 LLM 进行文本处理(如翻译、润色)。项目提供图形界面(GUI)、一键安装器和一体化包,旨在降低使用门槛,让非技术用户也能轻松创建高质量有声内容。Pandrator 集成了多种开源 TTS 引擎(如 Kokoro、Silero),支持多语言,适合个人创作者、教育工作者和内容本地化团队使用。目前项目处于早期阶段,但功能完整,社区活跃。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 627
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队lukaszliniewicz
所属国家
官网地址
定价模式free
价格说明完全免费开源,本地部署,无付费版本
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型audiobook,audiobook-creator,audiobook-maker,chatterbox,dubbing,dubbing-ai,kokoro,pdf-to-audio,rvc,silero,subtitle-to-speech,subtitle-to-voice,text-processing,text-to-speech,voice-clone,voice-cloning,voiceover,voxtral,xtts,xttsv2
GitHub 星标★ 627
30天Star增速
HF 下载量
上线时间2024-03-20 00:00:00
最近更新2026-09-23 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数8

使用教程

核心亮点

  • 完全本地运行,无需联网,保护隐私且零使用成本
  • 集成声音克隆和 RVC 音色增强,生成的有声书更自然
  • 提供 GUI 和安装器,对非技术用户友好

不足之处

  • 早期项目,文档和社区支持尚待完善
  • 本地模型对硬件要求较高,低配设备可能运行缓慢

适用场景

  • 将电子书转换为有声书,方便通勤或睡前听书
  • 为视频或字幕添加多语言配音,实现内容本地化
  • 创作者克隆自己的声音,批量生成播客或旁白

替代项目

Coqui TTS、OpenAudio、Kokoro TTS

项目介绍

Pandrator 是音频音乐领域的开源项目,由 lukaszliniewicz 开发,2024 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 627。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。完全免费开源,本地部署,无付费版本。

它主要面向的使用场景是:将电子书转换为有声书,方便通勤或睡前听书。同类可对比的替代方案包括 Coqui TTS、OpenAudio、Kokoro TTS。

上一篇:tiktok-voice

下一篇:ComfyUI-VibeVoice

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09