ChatTTS_colab

一键部署ChatTTS,流式输出、音色抽卡、长音频轻松搞定

ChatTTS_colab 是一个基于 ChatTTS 模型的一键部署工具,主要面向文本转语音(TTS)场景。它解决了 ChatTTS 原始项目部署复杂、上手门槛高的问题,通过提供 Colab 笔记本和离线整合包,让用户无需配置环境即可快速体验。核心能力包括:支持流式输出,实现边生成边播放;提供音色抽卡功能,方便用户挑选满意的声音;支持长音频生成,突破单次生成长度限制;支持分角色朗读,适合多角色对话场景。项目用 Python 编写,依赖 ChatTTS 模型,代码简洁,操作直观,适合非技术用户和开发者快速测试或集成。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 2592
维护状态 低维护
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队6drf21e
所属国家
官网地址
定价模式free
价格说明开源项目,本地部署或Colab使用,完全免费。
访问状态
是否开源
开源协议
主要语言Python
技术栈/模型chattts,colab-notebook,text-to-speech
GitHub 星标★ 2592
30天Star增速
HF 下载量
上线时间2024-05-30 00:00:00
最近更新2026-09-23 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数5

使用教程

难度:入门 约 20 分钟 部署方式:本地安装 7 步

环境要求

  • macOS 上需先安装 Conda
  • Python 3.11(README 用 conda 创建该版本环境)
  • 需能访问 GitHub,并允许首次运行时自动下载 ChatTTS 模型
  • 使用 Colab 方式需要浏览器与可打开 Notebook 的环境

安装与启动步骤

  1. 1Colab 一键运行

    想免配置可点顶部 Open In Colab,打开笔记本后执行“代码执行程序-全部运行”,在日志中找访问地址。

  2. 2创建 Conda 环境

    macOS 本地运行的第一步,新建名为 ChatTTS_colab 的 Python 3.11 环境。

    conda create -n "ChatTTS_colab" python=3.11
  3. 3激活环境

    后续所有安装与运行命令都要在这个已激活的环境中执行。

    conda activate ChatTTS_colab
  4. 4克隆项目仓库

    把 ChatTTS_colab 项目代码拉到本地,命令为 README 中的 SSH 地址形式。

    git clone git@github.com:6drf21e/ChatTTS_colab.git
  5. 5装入 ChatTTS 依赖

    按 README 在项目目录内克隆 ChatTTS,切到指定提交 e6412b1,再把 ChatTTS 子目录移到项目根目录。

    cd ChatTTS_colab
    git clone -q https://github.com/2noise/ChatTTS
    cd ChatTTS
    git checkout -q e6412b1
    cd ..
    mv ChatTTS temp
    mv temp/ChatTTS ./ChatTTS
    rm -rf temp
  6. 6安装项目依赖

    在项目目录中按 requirements-macos.txt 安装本项目所需依赖。

    cd ChatTTS_colab
    pip install -r requirements-macos.txt
  7. 7启动 WebUI

    运行启动脚本,首次会等待自动下载 ChatTTS 模型,正常时自动打开浏览器。

    python webui_mix.py

如何确认成功

启动后日志出现 Loading ChatTTS model...,模型加载完成会自动打开浏览器;Colab 方式则在日志里出现 Running on public URL: https://**********.gradio.live。

常见问题

Q:Colab 里怎么找到访问地址?

A:执行“代码执行程序–全部运行”后,在下方日志中找到类似 Running on public URL: https://**********.gradio.live 的一行,该地址就是可访问的公网入口。

Q:需要手动下载模型吗?

A:不需要。README 说明运行 python webui_mix.py 后会等待自动下载模型,首次启动时间较长属正常现象。

Q:Windows 用户怎么用?

A:README 提供了含 Win 离线整合包的下载渠道:百度网盘(提取码 h3c5)、夸克网盘和 Huggingface,下载后可直接使用,无需自己配环境。

Q:为什么要把 ChatTTS 克隆到项目里?

A:README 要求使用固定提交 e6412b1 的 ChatTTS,并把仓库中的 ChatTTS 子目录移动到项目根目录的 ./ChatTTS 后再安装依赖。

注意事项

  • README 只给出了 Colab 与 macOS 两套明确流程,其他系统未提供命令,请勿自行套用。
  • 克隆项目用的是 SSH 地址 git@github.com:6drf21e/ChatTTS_colab.git,未配置 SSH key 时需自行调整访问方式。
  • ChatTTS 需检出提交 e6412b1,不要随意换成其他版本,以免与本项目不兼容。
  • 长音频生成、音色抽卡、分角色朗读、流式输出均为项目内置功能,启动 WebUI 后即可体验。

核心亮点

  • 提供 Colab 和离线整合包,无需配置环境,双击即可运行
  • 支持流式输出,生成音频的同时即可播放,体验流畅
  • 内置音色抽卡和分角色朗读,满足多样化的语音合成需求

不足之处

  • 依赖 ChatTTS 模型,模型更新时需手动同步
  • 长音频生成可能受限于内存或显存,稳定性待观察

适用场景

  • 快速体验 ChatTTS 语音合成效果,无需本地安装
  • 在 Colab 中批量生成多角色对话音频,用于配音或播客
  • 开发者集成测试,验证 ChatTTS 在流式输出场景下的表现

替代项目

ChatTTS、edge-tts、bark

项目介绍

ChatTTS_colab 是音频音乐领域的开源项目,由 6drf21e 开发,2024 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(2,592)位列前 30%,在音频音乐分类的 738 个项目里位列前 9%。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-23。本地部署或Colab使用,完全免费。

它主要面向的使用场景是:快速体验ChatTTS语音合成效果,无需本地安装。同类可对比的替代方案包括 ChatTTS、edge-tts、bark。

上一篇:gTTS

下一篇:marytts

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09