ChatTTS-ui

本地网页一键文字转语音,还能当API用

ChatTTS-ui 是一个基于 Python 的本地网页界面,旨在为 ChatTTS 文本转语音模型提供便捷的操作入口。它解决了 ChatTTS 原生库缺乏可视化界面的问题,用户无需编写代码即可通过浏览器完成文字到语音的合成。项目核心能力包括:提供简洁的 Web UI 进行语音合成、支持实时预览和参数调节(如语速、音调)、内置多说话人选择、并对外提供 API 接口,方便集成到其他应用中。此外,它还支持批量处理文本和音频文件保存,适合个人开发者或小团队快速搭建 TTS 服务。整体设计轻量,部署简单,降低了 TTS 技术的使用门槛。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 7659
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队jianchang512
所属国家
定价模式free
价格说明开源项目,本地部署免费使用,无付费版本。
访问状态
是否开源是
开源协议NOASSERTION
主要语言Python
技术栈/模型chattts,tts
GitHub 星标★ 7659
30天Star增速
HF 下载量
上线时间2024-05-30 00:00:00
最近更新2026-09-22 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

难度:入门 约 15 分钟 部署方式:本地安装 7 步

环境要求

  • Python 3.9 - 3.11(Windows 安装时需勾选 Add Python to environment variables)
  • Git(Windows 可从 git-for-windows 官网下载安装)
  • 可选:NVIDIA 显卡且显存大于 4G,并安装 CUDA 12.8+ ToolKit 以启用 GPU 加速
  • 网络需能访问 modelscope.cn 或 huggingface.co 以下载模型

安装与启动步骤

  1. 1准备环境

    安装 Python 3.9-3.11 与 Git。Windows 安装 Python 时务必勾选 Add Python to environment variables,否则后续命令找不到 python。

  2. 2克隆项目

    先创建空的部署目录(示例 /data/chattts),在该目录下执行克隆。命令末尾的点表示克隆到当前目录。Windows 可换成 D:/chattts 并在地址栏输入 cmd 打开终端。

    cd /data/chattts && git clone https://github.com/jianchang512/chatTTS-ui .
  3. 3创建虚拟环境

    在项目根目录创建独立的 Python 虚拟环境 venv,避免依赖污染系统环境。Windows 下命令为 python -m venv venv。

    python3 -m venv venv
  4. 4激活虚拟环境

    激活后才能把依赖装进 venv。Windows 用 . envscriptsctivate,Mac/Linux 用 source ./venv/bin/activate。

    source ./venv/bin/activate
  5. 5安装项目依赖

    安装 requirements.txt 中列出的全部依赖,这一步耗时较长,请保持网络畅通。Windows 下把 pip3 换成 pip。

    pip3 install -r requirements.txt
  6. 6安装 torch

    不需要 GPU 加速时装 CPU 版即可;需要 CUDA 加速则用第二条命令,并另行安装 CUDA 12.8+ ToolKit。二者只需执行其一。

    pip3 install torch==2.7.1 torchaudio==2.7.1
    pip install torch==2.7.1 torchaudio==2.7.1 --index-url https://download.pytorch.org/whl/cu128
  7. 7启动服务

    执行后首次会自动下载模型,随后自动打开浏览器。注意默认从 modelscope 下载,不可使用代理,请先关闭代理。Windows 下命令为 python app.py。

    python3 app.py

关键配置

配置项必填说明示例
text是要合成语音的文字内容,API 请求必填你好,欢迎使用 ChatTTS
voice否决定音色的数字,可选 2222/7869/6653/4099/5099,传其他值将随机使用音色2222
prompt否设定笑声、停顿等控制符[oral_2][laugh_0][break_6]
temperature否采样温度,默认 0.30.3
top_p否核采样参数,默认 0.70.7
custom_voice否自定义音色种子值,需为大于 0 的整数,设置后忽略 voice1000

如何确认成功

启动后浏览器自动打开 http://127.0.0.1:9966,页面正常显示并能合成语音即成功;容器部署日志出现 0.0.0.0:9966 也可确认。

常见问题

Q:首次启动下载模型失败怎么办?

A:源码部署需确保能访问 huggingface.co,必要时科学上网;若走 modelscope 魔塔下载则不可使用代理,请先关闭代理再启动。

Q:有英伟达显卡但仍在用 CPU 跑?

A:先执行 pip uninstall -y torch torchaudio 卸载,再装 CUDA 版:pip install torch==2.7.1 torchaudio==2.7.1 --index-url https://download.pytorch.org/whl/cu128,且必须已安装 CUDA12.8+。

Q:Windows 预打包版被杀毒软件报毒?

A:README 说明部分安全软件可能误报,可退出安全软件后使用,或改用源码部署方式。

Q:Mac 上启动报缺少音频库?

A:先执行 brew install libsndfile git python@3.10 安装依赖,再按源码部署步骤创建虚拟环境并安装 requirements。

Q:怎么被其他程序调用?

A:服务对外提供 POST 接口 http://127.0.0.1:9966/tts,传 text 等参数即返回 json,含 wav 文件绝对路径与可下载 url。

注意事项

  • GPU 显存低于 4G 时会强制使用 CPU,属正常现象。
  • 源码部署首次启动会自动下载模型,耗时较长且必须保证网络可达。
  • 也可使用容器部署:git clone 后进入目录执行 docker compose -f docker-compose.gpu.yaml up -d(CPU 版把 gpu 换成 cpu),再用 docker compose logs -f --no-log-prefix 查看日志。
  • 容器部署完成后同一局域网可通过部署设备 IP:9966 访问,例如 http://192.168.1.100:9966。

核心亮点

  • 开箱即用的 Web 界面,无需编程即可合成语音
  • 内置 API 接口,方便集成到其他应用
  • 支持多说话人选择和参数调节,灵活度高

不足之处

  • 依赖 ChatTTS 模型,音质和稳定性受上游影响
  • 文档/社区待观察

适用场景

  • 快速生成语音demo或播客内容
  • 为个人项目提供本地TTS API服务
  • 教学演示或无障碍辅助工具开发

替代项目

ChatTTS、Coqui TTS、Mozilla TTS

项目介绍

ChatTTS-ui 是音频音乐领域的开源项目,由 jianchang512 开发,2024 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(7,659)位列前 7%,在音频音乐分类的 738 个项目里位列前 4%。

近 41 天,它的 GitHub 星标从 7,636 增加到 7,659,净增 23。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。本地部署免费使用,无付费版本。从国内网络环境看,可直接访问。

它主要面向的使用场景是:快速生成语音demo或播客内容。同类可对比的替代方案包括 ChatTTS、Coqui TTS、Mozilla TTS。

上一篇:erm

下一篇:ChatTTS-OpenVoice

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09