edge-tts

免密钥调用微软 Edge 语音,几行代码生成自然 MP3

edge-tts 是一个 Python 库,让你无需安装 Microsoft Edge、Windows 或申请 API key,就能直接调用微软 Edge 浏览器内置的在线文本转语音(TTS)服务。它通过模拟 Edge 的 WebSocket 接口,将文本转换为自然流畅的语音音频,支持多种语言和声音(如晓晓、云希等),可输出 MP3 格式。该工具解决了开发者快速获取高质量 TTS 能力的需求,尤其适合需要免费、无需复杂认证的语音合成场景。核心能力包括:简单的 API 调用、异步支持、自定义语速/音调/音量、批量生成音频文件,以及命令行工具。项目活跃,社区维护良好,是轻量级 TTS 解决方案中的热门选择。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 12000
维护状态 低维护
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队rany2
所属国家
官网地址
定价模式free
价格说明完全免费,无需API密钥,使用微软Edge在线TTS服务,需自行部署。
访问状态
是否开源
开源协议NOASSERTION
主要语言Python
技术栈/模型speech-synthesis,text-to-speech,tts
GitHub 星标★ 12000
30天Star增速
HF 下载量
上线时间2021-05-10 00:00:00
最近更新2026-09-22 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数7

使用教程

难度:入门 约 10 分钟 部署方式:命令行工具 6 步

环境要求

  • Python 环境(需可用 pip 安装包)
  • 如需只用命令行工具,建议安装 pipx
  • 使用 edge-playback 播放需额外安装 mpv 命令行播放器(Windows 除外)
  • 可联网环境,TTS 使用微软 Edge 在线服务

安装与启动步骤

  1. 1安装 edge-tts

    用 pip 安装 edge-tts,即可在 Python 代码或命令行中使用,无需 Edge 浏览器和 API key。

    pip install edge-tts
  2. 2改用 pipx 安装

    若只用 edge-tts 与 edge-playback 命令,README 建议用 pipx 安装,隔离环境更干净。

    pipx install edge-tts
  3. 3生成首个音频

    指定文本,输出 MP3 音频和 SRT 字幕两个文件,文件写在你执行命令的当前目录。

    edge-tts --text "Hello, world!" --write-media hello.mp3 --write-subtitles hello.srt
  4. 4查看可用声音

    列出所有可用的声音名称、性别等,方便后续用 --voice 指定想要的声音。

    edge-tts --list-voices
  5. 5指定声音合成

    用 --voice 传入上一步列表中看到的声音名,其余参数与默认用法一致。

    edge-tts --voice af-ZA-AdriNeural --text "Hello, world!" --write-media hello.mp3
  6. 6直接播放音频

    edge-playback 可即时播放并带字幕,需已安装 mpv(Windows 除外),不需要写文件。

    edge-playback --text "Hello, world!"

关键配置

配置项必填说明示例
--text要转换的文本内容"Hello, world!"
--voice指定语音服务使用的声音名称af-ZA-AdriNeural
--write-media把合成的音频写入指定文件hello.mp3
--write-subtitles把字幕写入指定 SRT 文件hello.srt
--list-voices列出全部可用声音及其信息

如何确认成功

命令执行后当前目录出现 hello.mp3 与 hello.srt;执行 --list-voices 能打印出声音列表即正常。

常见问题

Q:edge-playback 报错找不到 mpv 怎么办?

A:edge-playback 依赖 mpv 命令行播放器(Windows 除外),按 mpv 官网说明安装后再试,或改用 edge-tts 输出文件。

Q:怎么知道有哪些声音可选?

A:运行 edge-tts --list-voices,会输出 Name、Gender、ContentCategories、VoicePersonalities 等列,把 Name 值传给 --voice。

Q:edge-playback 支持全部参数吗?

A:不全部支持,它不能用 --write-media、--write-subtitles 和 --list-voices,其余 edge-tts 参数与它通用。

Q:如何避免把包装进全局环境?

A:如果只想用 edge-tts 和 edge-playback 命令,README 建议用 pipx install edge-tts 安装。

注意事项

  • README 未说明所需 Python 版本,安装前请先确认本机 Python 与 pip 可用。
  • edge-tts 调用的是微软 Edge 在线 TTS 服务,使用时需保持网络连通。
  • --list-voices 示例输出以 af-ZA-AdriNeural 等声音名为准,实际可选声音以命令输出为准。

核心亮点

  • 无需 API key 和微软账号,开箱即用,零成本
  • 提供 300+ 种神经语音,覆盖多语言,音质自然
  • 支持异步和命令行,方便集成到自动化流程

不足之处

  • 依赖微软在线服务,网络波动可能影响稳定性
  • 文档/社区待观察

适用场景

  • 快速生成视频配音或播客音频
  • 为应用添加语音播报功能
  • 批量合成多语言语音用于学习或测试

替代项目

pyttsx3、gTTS、Coqui TTS

项目介绍

edge-tts 是音频音乐领域的开源项目,由 rany2 开发,2021 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(12,000)位列前 5%,在音频音乐分类的 738 个项目里位列前 3%。

近 44 天,它的 GitHub 星标从 11,698 增加到 12,000,净增 302。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。完全免费,无需API密钥,使用微软Edge在线TTS服务,需自行部署。

它主要面向的使用场景是:快速生成视频配音或播客音频。同类可对比的替代方案包括 pyttsx3、gTTS、Coqui TTS。

上一篇:HunyuanVideo-Foley

下一篇:Amphion

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09