Irodori-TTS-Server

一键部署 OpenAI 兼容的 TTS 服务,轻松实现语音合成与克隆

Irodori-TTS-Server 是一个基于 Python 的文本转语音(TTS)服务端,它实现了 OpenAI 的 Text-to-Speech API 兼容接口,让开发者可以无缝替换或对接现有的 OpenAI TTS 应用。该项目主要解决的是自托管 TTS 服务与 OpenAI 生态兼容的问题,使得用户能够利用 Irodori-TTS 引擎(一个专注于高质量语音合成的模型)提供语音生成能力,同时保持 API 调用方式与 OpenAI 一致,降低迁移成本。其核心能力包括:提供标准的 /v1/audio/speech 端点,支持流式音频返回,支持多种语音参数配置,并集成了语音克隆功能,允许用户基于少量样本生成个性化音色。项目采用 Python 编写,部署简单,适合需要私有化部署、数据隐私保护或定制化语音合成的场景。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 77
维护状态 较活跃
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队Aratako
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,完全免费,需自行部署。
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型openai-compatible,python,speech-synthesis,text-to-speech,tts,voice-cloning
GitHub 星标★ 77
30天Star增速
HF 下载量
上线时间2026-05-14 00:00:00
最近更新2026-09-21 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

核心亮点

  • 完全兼容 OpenAI TTS API,现有代码零改动即可切换
  • 内置语音克隆功能,支持用少量音频样本生成个性化音色
  • Python 实现,部署简单,适合私有化部署和二次开发

不足之处

  • 项目处于早期阶段,文档和社区支持尚待完善
  • 依赖 Irodori-TTS 模型,语音质量受限于该模型的表现

适用场景

  • 需要私有化部署 TTS 服务且要求 API 与 OpenAI 兼容的企业应用
  • 基于现有 OpenAI TTS 应用快速迁移到自托管方案
  • 需要个性化语音克隆的语音助手或内容生成工具

替代项目

Coqui TTS、Mimic3、OpenTTS

项目介绍

Irodori-TTS-Server 是音频音乐领域的开源项目,由 Aratako 开发,是 2026 年新上线的项目。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 77。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。MIT许可证,完全免费,需自行部署。

它主要面向的使用场景是:需要私有化部署TTS服务且要求API与OpenAI兼容的企业应用。同类可对比的替代方案包括 Coqui TTS、Mimic3、OpenTTS。

上一篇:java-tts

下一篇:OpenAI-TTS-Gradio

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09