Unitale 是音频音乐领域的开源项目,由 sdsds222 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 224。
项目仍在小幅维护中,最近一次代码更新于 2026-09-24。MIT许可证,浏览器直接使用,完全免费。从国内网络环境看,可直接访问。
它主要面向的使用场景是:个人创作者快速制作有声书或播客。同类可对比的替代方案包括 Coqui TTS、ElevenLabs、F5-TTS。

浏览器里一键把剧本变成带音效和配图的有声书
Unitale 是一款基于 IndexTTS 和 Qwen3TTS 的 AI 有声书制作工具,旨在解决从文本到成品有声书的全流程自动化问题。它利用 LLM 自动拆解剧本并识别角色情绪,集成多角色 TTS 语音合成,能智能分析音色并通过 Qwen3TTS 语音设计模型从文本描述生成音色。工具支持音效和背景音乐的混音,以及实时台词音频滤波器的自动插入与匹配,最终可在浏览器中直接导出 WAV 文件,无需配置环境即可跨平台使用。此外,它还支持背景图片提示词生成,可一键导出包含情节背景图片和故事音频的 MP4 视频。核心能力包括剧本解析、情绪识别、多角色语音合成、音效混音和视频生成,适合创作者快速制作有声书或播客内容。
Coqui TTS、ElevenLabs、F5-TTS
Unitale 是音频音乐领域的开源项目,由 sdsds222 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 224。
项目仍在小幅维护中,最近一次代码更新于 2026-09-24。MIT许可证,浏览器直接使用,完全免费。从国内网络环境看,可直接访问。
它主要面向的使用场景是:个人创作者快速制作有声书或播客。同类可对比的替代方案包括 Coqui TTS、ElevenLabs、F5-TTS。
上一篇:tts-now
下一篇:kokoro-onnx
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···