VoxNovel

一键把电子书变成多人配音的有声书

VoxNovel 是一个将电子书转换为有声书的开源工具,核心特点是能为书中每个角色分配不同的配音演员,实现多角色语音合成。它解决的是传统 TTS 生成有声书时声音单一、缺乏表现力的问题,通过整合 BookNLP 进行角色识别和对话提取,结合 StyleTTS2 等先进语音合成模型,自动为不同角色生成风格各异的语音。支持 EPUB、TXT 等常见电子书格式,输出 M4B 等有声书标准格式,并兼容 Linux 和 macOS 系统。项目提供命令行和图形界面,用户可自定义语音参数,适合个人创作者、播客制作者和独立开发者快速生成高质量的多角色有声内容。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 375
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队DrewThomasson
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型audiobook-creator,audiobooks,booknlp,epub,generative-ai,linux,m4b,mac,multi-speaker,styletts2,torch,torchaudio,tts,voice-cloning,windows
GitHub 星标★ 375
30天Star增速
HF 下载量
上线时间2023-11-17 00:00:00
最近更新2026-09-15 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 自动识别书中角色并为每个角色分配独立音色,显著提升有声书沉浸感
  • 集成 BookNLP 和 StyleTTS2,技术栈先进,语音自然度高
  • 支持 EPUB 转 M4B 完整流程,输出格式标准,便于播放和分发

不足之处

  • 早期项目,文档和社区支持尚待完善
  • 依赖多个重型模型,安装和运行资源消耗较高

适用场景

  • 个人创作者将小说快速转化为多角色有声书
  • 独立开发者集成多角色 TTS 到自有阅读应用
  • 教育领域制作多角色对话式听力材料

替代项目

Coqui TTS、Edge TTS、pyttsx3

项目介绍

VoxNovel 是音频音乐领域的开源项目,由 DrewThomasson 开发,2023 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 375。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-15。MIT许可证,完全免费,可自行部署使用。

它主要面向的使用场景是:个人创作者将小说快速转化为多角色有声书。同类可对比的替代方案包括 Coqui TTS、Edge TTS、pyttsx3。

上一篇:HebTTS

下一篇:fish-speech.rs

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09