chatterbox-tts-api

本地跑个 OpenAI 兼容的语音克隆 API,随便接进你的 AI 应用

Chatterbox TTS API 是一个本地部署的、兼容 OpenAI 接口的文本转语音服务,基于 Chatterbox 模型实现声音克隆。它解决了在本地或私有环境中使用高质量语音合成的问题,同时保持与现有 OpenAI API 生态的无缝集成。用户可以通过简单的 API 调用,在任何支持 OpenAI 接口的应用(如 Open WebUI、AnythingLLM)中直接使用语音克隆功能,无需修改现有代码。项目支持 CUDA 加速和 Docker 部署,方便在本地或服务器上运行。核心能力包括:文本转语音、声音克隆、OpenAI 兼容接口、流式输出等。它特别适合需要个性化语音助手、有声内容生成或无障碍应用的开发者,能够快速集成到现有 AI 工作流中。

开源 unknown 对话助手
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 682
维护状态 低维护
是否开源 是
定价模式 unknown

项目数据

分类对话助手
开发团队travisvn
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议AGPL-3.0
主要语言Python
技术栈/模型ai,chatgpt,chatterbox,cuda,docker,elevenlabs,gpt,local-llm,ollama,open-webui,openai,openai-api,python,self-hosted,speech,text-to-speech,tts,voice-clone,voice-cloning
GitHub 星标★ 682
30天Star增速
HF 下载量
上线时间2025-05-31 00:00:00
最近更新2026-09-22 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数6

使用教程

核心亮点

  • 完全兼容 OpenAI 音频接口,现有应用改个 base_url 就能用,接入成本极低
  • 支持声音克隆,只需几秒参考音频即可生成个性化语音
  • 提供 Docker 镜像和 CUDA 支持,部署灵活,可充分利用 GPU 加速

不足之处

  • 早期项目,文档和社区支持尚待完善
  • 语音克隆质量依赖参考音频,对音频清晰度要求较高

适用场景

  • 在 Open WebUI 或 AnythingLLM 中为聊天机器人添加语音回复功能
  • 为有声书、播客等内容创作工具提供本地语音合成服务
  • 在隐私敏感场景下,替代云端 TTS 服务,实现数据不出本地

替代项目

Coqui TTS、Piper、MeloTTS

项目介绍

chatterbox-tts-api 是音频音乐领域的开源项目,由 travisvn 开发,2025 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 682。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。从国内网络环境看,可直接访问。

它主要面向的使用场景是:在OpenWebUI或AnythingLLM中为聊天机器人添加语音回复功能。同类可对比的替代方案包括 Coqui TTS、Piper、MeloTTS。

上一篇:epub_to_audiobook

下一篇:open-audio

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09