TTS-Story

用标签脚本一键生成多角色有声书,本地或云端引擎任选。

TTS-Story 是一个基于 Web 的多语音 TTS 工作室,专为将带标签的脚本转换为有声书而设计。它解决了有声书制作中多角色配音管理复杂、音频生成分散的问题,提供完整的说话人管理、片段审查与重新生成、任务队列和库系统。支持本地 GPU 或 API 后端,集成 Kokoro、Chatterbox、VOX CPM、Pocket-TTS、Kitten-TTS、IndexTTS-2、QWEN3 TTS 和 Omnivoice 等多种引擎,用户可灵活选择。核心能力包括:通过标签脚本自动分配不同语音、逐片段精细调整、批量任务处理以及音频资源库管理,显著提升有声书制作效率。项目处于早期阶段,适合技术用户快速上手。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 337
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队Xerophayze
所属国家
官网地址
定价模式free
价格说明开源项目,本地部署或自托管,无在线服务,全部功能免费。
访问状态
是否开源是
开源协议NOASSERTION
主要语言Python
技术栈/模型chatterbox-tts,indextts-2,kokoro-tts,omnivoice,pinokio,qwen3-tts,tts,voxcpm
GitHub 星标★ 337
30天Star增速
HF 下载量
上线时间2025-11-14 00:00:00
最近更新2026-09-22 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数7

使用教程

核心亮点

  • 集成8种主流TTS引擎,覆盖本地GPU与API,选择灵活
  • 支持完整说话人管理,标签脚本自动分配角色语音
  • 提供片段级审查与重新生成,保证音频质量可控

不足之处

  • 早期项目,文档和社区支持待观察
  • 依赖多种TTS引擎,部署配置复杂度较高

适用场景

  • 有声书制作人批量生成多角色音频
  • 播客或广播剧创作者快速配音
  • TTS技术爱好者测试对比不同引擎效果

替代项目

Coqui TTS、Mimic 3、Edge TTS

项目介绍

TTS-Story 是音频音乐领域的开源项目,由 Xerophayze 开发,2025 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 336。

近 42 天,它的 GitHub 星标从 308 增加到 336,净增 28。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-16。本地部署或自托管,无在线服务,全部功能免费。

它主要面向的使用场景是:有声书制作人批量生成多角色音频。同类可对比的替代方案包括 Coqui TTS、Mimic 3、Edge TTS。

上一篇:readest

下一篇:Advanced-RVC-Inference

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09