elevenlabs-python

一行代码调用 ElevenLabs,生成逼真 AI 语音

ElevenLabs 官方 Python SDK,用于调用 ElevenLabs API,提供文本转语音、语音克隆、声音库管理、语音合成流式输出等能力。它封装了 REST API 和 WebSocket 接口,支持生成高质量、多语言、多音色的 AI 语音,并支持实时流式合成,适用于配音、有声书、语音助手、游戏角色配音等场景。SDK 设计简洁,通过 API key 即可快速上手,并提供了同步和异步客户端,方便集成到各类 Python 应用中。

开源 pay_as_you_go 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 3106
维护状态 活跃
是否开源
定价模式 pay_as_you_go

项目数据

分类音频音乐
开发团队elevenlabs
所属国家
定价模式pay_as_you_go
价格说明ElevenLabs API官方SDK,服务按用量计费,有免费额度,按字符或点数扣费,无固定订阅套餐。
访问状态
是否开源
开源协议MIT
主要语言Python
技术栈/模型artificial-intelligence,conversational-ai,text-to-speech
GitHub 星标★ 3106
30天Star增速
HF 下载量
上线时间2023-03-26 00:00:00
最近更新2026-09-23 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数9

使用教程

难度:入门 约 10 分钟 部署方式:库/依赖 5 步

环境要求

  • 可用的 Python 环境(README 未标注最低版本要求)
  • ElevenLabs 账号与 API Key(示例中写作 YOUR_API_KEY)
  • 能访问 ElevenLabs API 的网络环境
  • 可选:python-dotenv,示例中使用 load_dotenv() 读取 .env 配置

安装与启动步骤

  1. 1安装 SDK

    README 给出的唯一安装方式是 pip,直接安装官方包即可,无需克隆仓库。

    pip install elevenlabs
  2. 2获取 API Key

    前往 ElevenLabs 官网注册并获取 API Key,调用客户端时必须提供,否则无法鉴权。

  3. 3初始化客户端

    导入 ElevenLabs 客户端并传入 api_key;若用 .env 存密钥可先 load_dotenv() 再空参初始化。

    from dotenv import load_dotenv
    from elevenlabs.client import ElevenLabs
    
    load_dotenv()
    
    elevenlabs = ElevenLabs(api_key="YOUR_API_KEY")
  4. 4合成第一段语音

    调用 text_to_speech.convert 传入文本和 voice_id,返回音频数据,可写入文件保存。

    audio = elevenlabs.text_to_speech.convert(
        text="The first move is what sets everything in motion.",
        voice_id="JBFqnCBsd6RMkjVDRZ",
    )
  5. 5播放音频

    README 展示了从 elevenlabs.play 导入 play 用于播放生成音频,具体调用参数请查阅官方文档。

    from elevenlabs.play import play

关键配置

配置项必填说明示例
api_keyElevenLabs API 身份认证密钥,初始化客户端时传入YOUR_API_KEY
voice_id合成所用音色 ID,作为 convert 的必填参数传入JBFqnCBsd6RMkjVDRZ

如何确认成功

示例代码运行无报错且 convert 返回非空音频数据,说明 SDK 与 API Key 均已配置成功。

常见问题

Q:有哪些模型可选?

A:README 列出 eleven_v3(70+ 语言、多说话人对话)、eleven_multilingual_v2(29 种语言,推荐多数场景)、eleven_flash_v2_5(超低延迟、价格低 50%)、eleven_turbo_v2_5(质量与延迟均衡)。

Q:没有 API Key 能用吗?

A:不能,示例中初始化客户端必须提供 api_key(示例值 YOUR_API_KEY),需先在 ElevenLabs 官网注册获取。

Q:SDK 支持异步调用吗?

A:支持,README 提供了 AsyncElevenLabs 和 asyncio 的示例,可配合异步框架使用。

Q:示例里的 dotenv 和 openai 是必须的吗?

A:不是。load_dotenv 只在用 .env 管理密钥时需要;openai 只出现在语音引擎进阶示例中,按需安装。

注意事项

  • README 未注明支持的 Python 最低版本,建议使用较新的 Python 3 环境
  • 不要把 API Key 硬编码进代码或提交到仓库,推荐用 .env + load_dotenv() 方式管理
  • README 展示的示例代码存在截断(如 voice_id 与部分代码块),实际使用时请以官方文档 https://elevenlabs.io/docs/api-reference 为准

核心亮点

  • 官方维护,API 覆盖全面,紧跟 ElevenLabs 新功能
  • 支持同步/异步客户端及流式合成,灵活适配不同场景
  • 内置声音克隆和声音库管理,方便定制专属音色

不足之处

  • 依赖 ElevenLabs 云服务,离线不可用且需付费
  • 文档示例偏少,高级用法需参考源码

适用场景

  • 为视频/播客生成多语言配音
  • 构建语音助手或客服机器人
  • 游戏或动画角色实时语音合成

替代项目

Coqui TTS、edge-tts、pyttsx3

项目介绍

elevenlabs-python 是音频音乐领域的开源项目,由 elevenlabs 开发,2023 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(3,106)位列前 30%,在音频音乐分类的 738 个项目里位列前 7%。

近 45 天,它的 GitHub 星标从 3,058 增加到 3,106,净增 48。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。ElevenLabs API官方SDK,服务按用量计费,有免费额度,按字符或点数扣费,无固定订阅套餐。

它主要面向的使用场景是:为视频/播客生成多语言配音。同类可对比的替代方案包括 Coqui TTS、edge-tts、pyttsx3。

上一篇:TTS-WebUI

下一篇:aeneas

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09