tts-audiobook-tool 是音频音乐领域的开源项目,由 zeropointnine 开发,2025 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 213。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-24。MIT许可证,可免费自部署使用。
它主要面向的使用场景是:个人创作者制作有声书或播客。同类可对比的替代方案包括 Coqui TTS、Mimic3、Edge TTS。

一个工具集成多种TTS模型,轻松制作高品质有声书
这是一个专注于高质量有声书创作的开源工具,集成了大量主流TTS模型(如Qwen3-TTS、OmniVoice、VibeVoice等),用户可以通过统一接口调用不同语音合成引擎,生成自然流畅的音频。项目包含三个核心组件:一是创作应用,支持多模型切换、参数调优,以输出高品质音频;二是音频同步阅读器Web应用,可边听边看,提升阅读体验;三是独立的服务器组件,方便部署和集成到其他系统。它解决了有声书制作中模型选择困难、音频质量参差不齐、工具链分散的问题,为创作者提供了一站式解决方案。项目处于早期阶段,但已展现出强大的模型兼容性和清晰的架构设计。
Coqui TTS、Mimic3、Edge TTS
tts-audiobook-tool 是音频音乐领域的开源项目,由 zeropointnine 开发,2025 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 213。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-24。MIT许可证,可免费自部署使用。
它主要面向的使用场景是:个人创作者制作有声书或播客。同类可对比的替代方案包括 Coqui TTS、Mimic3、Edge TTS。
上一篇:sea-g2p
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···