document-to-podcast 是音频音乐领域的开源项目,由 mozilla-ai 开发,2024 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 183。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-05。本地部署,完全免费。
它主要面向的使用场景是:将长报告或论文转换为通勤时收听的播客。同类可对比的替代方案包括 OpenAI TTS、ElevenLabs、Podcastfy。

本地AI把文档一键变成播客,隐私安全又高效
document-to-podcast 是 Mozilla.ai 推出的一个开源蓝图项目,旨在利用本地 AI 技术将文档自动转化为播客音频。它解决的是内容创作者和知识工作者将长篇文档(如报告、论文、新闻)快速转换为可听内容的需求,无需依赖云端服务,保障数据隐私。项目核心能力包括:基于本地大语言模型对文档进行摘要、改写和对话式脚本生成,再通过文本转语音(TTS)引擎合成自然语音,最终输出完整的播客音频文件。整个流程支持自定义,用户可调整脚本风格、语音参数等。项目采用 Python 编写,技术栈涵盖 local-ai、podcast、text-to-speech 和 text-to-text,适合技术用户本地部署。目前处于早期阶段,星标数180,但背靠 Mozilla.ai,具有较好的发展潜力。
OpenAI TTS、ElevenLabs、Podcastfy
document-to-podcast 是音频音乐领域的开源项目,由 mozilla-ai 开发,2024 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 183。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-05。本地部署,完全免费。
它主要面向的使用场景是:将长报告或论文转换为通勤时收听的播客。同类可对比的替代方案包括 OpenAI TTS、ElevenLabs、Podcastfy。
上一篇:kokoclone
下一篇:elevenlabs-node
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···