pdf-narrator

把 PDF/EPUB 一键变成有声书,低配电脑也能流畅跑

pdf-narrator 是一个将 PDF 和 EPUB 文档转换为有声书的开源工具,专为低资源系统设计。它解决了传统文档转音频过程中文本提取不准确、处理速度慢、对硬件要求高的问题。核心能力包括智能文本提取(能够处理复杂排版)、可定制的文本转语音设置(支持多种 TTS 引擎,如 Kokoro TTS),以及高效的批处理流程,即使在配置较低的设备上也能流畅运行。项目采用 Python 编写,技术栈简洁,易于扩展和集成。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 208
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队mateogon
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型audiobook,audiobook-generator,epub,immersive-reading,kokoro-tts,low-resource,pdf,pdf-audiobook,pdf-extraction,pdf-to-audiobook,text-to-speech,tts
GitHub 星标★ 208
30天Star增速
HF 下载量
上线时间2024-12-15 00:00:00
最近更新2026-09-24 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

核心亮点

  • 智能文本提取,能处理复杂排版的 PDF,减少乱码和错位
  • 支持 Kokoro TTS 等引擎,可调节语速、音色等参数,满足个性化听书需求
  • 针对低资源系统优化,内存占用小,处理速度快,老电脑也能用

不足之处

  • 文档/社区待观察

适用场景

  • 通勤或运动时听学术论文、电子书,解放双眼
  • 视障用户辅助阅读,将文档转为语音
  • 批量转换大量 PDF/EPUB 为音频,用于播客制作或学习资料整理

替代项目

AudioBookConverter、epub2audiobook、Tikatok

项目介绍

pdf-narrator 是音频音乐领域的开源项目,由 mateogon 开发,2024 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 208。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-24。MIT许可证,完全免费,可自行部署使用。

它主要面向的使用场景是:通勤或运动时听学术论文、电子书,解放双眼。同类可对比的替代方案包括 AudioBookConverter、epub2audiobook、Tikatok。

上一篇:AndroidMaryTTS

下一篇:fish-audio-python

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09