document-to-podcast

本地AI把文档一键变成播客,隐私安全又高效

document-to-podcast 是 Mozilla.ai 推出的一个开源蓝图项目,旨在利用本地 AI 技术将文档自动转化为播客音频。它解决的是内容创作者和知识工作者将长篇文档(如报告、论文、新闻)快速转换为可听内容的需求,无需依赖云端服务,保障数据隐私。项目核心能力包括:基于本地大语言模型对文档进行摘要、改写和对话式脚本生成,再通过文本转语音(TTS)引擎合成自然语音,最终输出完整的播客音频文件。整个流程支持自定义,用户可调整脚本风格、语音参数等。项目采用 Python 编写,技术栈涵盖 local-ai、podcast、text-to-speech 和 text-to-text,适合技术用户本地部署。目前处于早期阶段,星标数180,但背靠 Mozilla.ai,具有较好的发展潜力。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 183
维护状态 活跃
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队mozilla-ai
所属国家
定价模式free
价格说明开源项目,本地部署,完全免费
访问状态
是否开源
开源协议Apache-2.0
主要语言Python
技术栈/模型local-ai,podcast,text-to-speech,text-to-text
GitHub 星标★ 183
30天Star增速
HF 下载量
上线时间2024-11-14 00:00:00
最近更新2026-09-05 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数6

使用教程

核心亮点

  • 完全本地运行,文档内容不出设备,隐私保护强
  • 流程自动化,从文档到播客音频全链路打通,省时省力
  • 基于Mozilla.ai背书,技术架构可靠,扩展性好

不足之处

  • 早期项目,文档和社区支持尚不完善
  • 音频质量依赖所选TTS引擎,可能不如商业服务自然

适用场景

  • 将长报告或论文转换为通勤时收听的播客
  • 内容创作者快速生成音频版本的文章或新闻
  • 企业内部将培训材料或文档转为音频供员工学习

替代项目

OpenAI TTS、ElevenLabs、Podcastfy

项目介绍

document-to-podcast 是音频音乐领域的开源项目,由 mozilla-ai 开发,2024 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 183。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-05。本地部署,完全免费。

它主要面向的使用场景是:将长报告或论文转换为通勤时收听的播客。同类可对比的替代方案包括 OpenAI TTS、ElevenLabs、Podcastfy。

上一篇:kokoclone

下一篇:elevenlabs-node

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09