gTTS

几行代码调用谷歌翻译,把文字变成语音

gTTS 是一个 Python 库和命令行工具,用于调用 Google Translate 的文本转语音 API,将文本转换为 MP3 音频。它解决了开发者快速实现文本朗读功能的需求,无需复杂的机器学习模型或云服务配置。核心能力包括:将字符串或文本文件转换为语音,支持多种语言和口音,提供简单易用的 API 和 CLI 接口,可生成可播放的 MP3 文件。它适合需要临时或轻量级 TTS 功能的场景,如语音提示、自动化播报、语言学习工具等。gTTS 依赖 Google 服务,因此需要网络连接,并且不支持离线使用。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 2636
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队pndurette
所属国家
官网地址
定价模式free
价格说明开源免费,MIT许可证,可自由使用和修改。
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型cli,gtts,pypi,python,python-library,speech,speech-api,text-to-speech,tts
GitHub 星标★ 2636
30天Star增速
HF 下载量
上线时间2014-05-15 00:00:00
最近更新2026-09-21 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

难度:入门 约 5 分钟 部署方式:库/依赖 3 步

环境要求

  • Python 环境(README 未指定版本,建议 Python 3)
  • 可联网(依赖 Google Translate 的 TTS 服务,不支持离线)
  • pip 包管理工具

安装与启动步骤

  1. 1安装 gTTS

    用 pip 从 PyPI 安装 gTTS,同时会装上 gtts-cli 命令行工具。

    pip install gTTS
  2. 2命令行生成语音

    用 gtts-cli 把一段文本合成 MP3,--output 指定输出文件名。

    gtts-cli 'hello' --output hello.mp3
  3. 3Python 代码调用

    在脚本中导入 gTTS,构造对象后调用 save 保存为 MP3 文件。

    from gtts import gTTS
    tts = gTTS('hello')
    tts.save('hello.mp3')

如何确认成功

运行命令或代码后当前目录出现 hello.mp3,用播放器能听到合成的英语语音即为成功。

常见问题

Q:gTTS 能离线使用吗?

A:不能。它调用 Google Translate 的语音功能,必须保持网络连接,且上游接口变更可能导致不可用。

Q:这是 Google 官方服务吗?

A:不是。项目与 Google 及 Google Cloud 无关联,使用的是未公开的 Google Translate 语音接口,区别于 Google Cloud Text-to-Speech。

Q:支持哪些语言?

A:README 未列出具体语言列表,请查阅官方文档 https://gtts.readthedocs.io/ 了解支持的语言与口音。

Q:pip install 失败怎么办?

A:确认 pip 已安装且网络可访问 PyPI,可尝试升级 pip 或更换国内镜像源后重试。

注意事项

  • gTTS 依赖 Google 服务,需联网使用,不支持离线。
  • 上游非公开接口可能随时变更,导致功能失效且无预告。
  • 仅输出 MP3 音频,不提供语音识别等反向功能。

核心亮点

  • API 极简,几行代码即可将文本转为 MP3 语音
  • 支持 100+ 种语言和口音,覆盖广
  • 提供 CLI 工具,无需写代码也能生成语音

不足之处

  • 依赖 Google 在线服务,网络受限地区不可用
  • 语音自然度一般,不如专业 TTS 引擎
  • 文档/社区待观察

适用场景

  • 为个人脚本或小工具添加语音播报功能
  • 快速生成多语言语音样本用于测试或学习
  • 自动化生成语音文件用于视频或播客素材

替代项目

pyttsx3、edge-tts、espeak

项目介绍

gTTS 是音频音乐领域的开源项目,由 pndurette 开发,2014 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(2,636)位列前 30%,在音频音乐分类的 738 个项目里位列前 9%。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-21。开源免费,MIT许可证,可自由使用和修改。

它主要面向的使用场景是:为个人脚本或小工具添加语音播报功能。同类可对比的替代方案包括 pyttsx3、edge-tts、espeak。

上一篇:MARS5-TTS

下一篇:ChatTTS_colab

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09