ms-ra-forwarder

免费调用微软神经网络语音,快速搭建文本转语音服务

ms-ra-forwarder 是一个基于 TypeScript 开发的免费在线文本转语音(TTS)API 服务。它通过转发微软 Edge 浏览器内置的神经网络语音合成接口,将文本转换为自然流畅的语音,无需申请 Azure 密钥或付费。项目核心能力包括:提供简单的 REST API 接口,支持多种语言和声音(如中文、英文、日文等),可自定义语速、音调和音量,并支持 SSML 标记。它解决了开发者快速集成高质量 TTS 功能的需求,尤其适合个人项目、演示或低成本应用。部署简单,可通过 Docker 或 Node.js 直接运行,社区活跃,持续更新。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1058
维护状态 低维护
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队wxxxcxx
所属国家
定价模式free
价格说明免费在线文本转语音API,无付费版本
访问状态
是否开源
开源协议
主要语言TypeScript
技术栈/模型tts,tts-api
GitHub 星标★ 1058
30天Star增速
HF 下载量
上线时间2022-01-08 00:00:00
最近更新2026-09-14 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

难度:入门 约 10 分钟 部署方式:Docker 7 步

环境要求

  • 已安装 Docker(Docker / Docker Compose 部署方式需要)
  • 已安装 git 和 Node.js(仅手动运行时需要)
  • 可访问 3000 端口(默认映射端口)

安装与启动步骤

  1. 1拉取镜像

    从 Docker Hub 拉取官方镜像,推荐使用 Docker 方式部署。

    docker pull wxxxcxx/ms-ra-forwarder:latest
  2. 2启动容器

    以守护模式运行容器,并把容器 3000 端口映射到本机 3000。

    docker run --name ms-ra-forwarder -d -p 3000:3000 wxxxcxx/ms-ra-forwarder
  3. 3创建 Compose 文件

    如需用 Compose 管理,新建 docker-compose.yml 并写入以下内容,不需要 TOKEN 时删除该行。

    version: '3'
    
    services:
      ms-ra-forwarder:
        container_name: ms-ra-forwarder
        image: wxxxcxx/ms-ra-forwarder:latest
        restart: unless-stopped
        ports:
          - 3000:3000
        environment:
          # 不需要可以不用设置环境变量
          - TOKEN=sk-xxxxxxxx
  4. 4启动 Compose 服务

    在 docker-compose.yml 所在目录执行,后台拉起服务。

    docker compose up -d
  5. 5获取源码

    手动运行方式,先用 git 克隆仓库并进入项目目录。

    git clone https://github.com/wxxxcxx/ms-ra-forwarder.git
    cd ms-ra-forwarder
  6. 6安装依赖并构建

    需要事先安装好 git 和 Node.js,安装依赖后执行构建。

    npm install
    npm run build
  7. 7启动服务

    构建完成后启动 Node 服务,访问本机 3000 端口即可。

    npm run start

关键配置

配置项必填说明示例
TOKEN设置后可限制他人滥用,请求时需在请求头携带该令牌sk-xxxxxxxx

如何确认成功

浏览器访问 http://localhost:3000,在页面中测试语音合成没有问题即表示部署成功。

常见问题

Q:如何防止他人滥用我部署的服务?

A:在环境变量中添加 TOKEN,并在请求头中加上 Authorization: Bearer 访问即可。

Q:为什么 Railway 部署有时用不了?

A:Railway 每月有 500 小时限制且不会自动停机,所以每个月会有一段时间无法使用,有条件建议用 Docker 部署。

Q:怎么手动调用语音合成接口?

A:接口地址为 /api/text-to-speech,例如 GET /api/text-to-speech?voice=Microsoft+Server+Speech+Text+to+Speech+Voice+(zh-CN,+XiaoxiaoNeural)&volume=0&rate=0&pitch=0&text=你好。

Q:需要申请 Azure 密钥或付费吗?

A:不需要,项目通过转发微软 Edge 浏览器内置的语音合成接口实现,免费使用。

注意事项

  • Docker 部署为推荐方式,部署在 Vercel 时请删除原项目重新部署。
  • 手动运行需要事先安装好 git 和 nodejs。
  • 微软官方 Azure TTS 有一定免费额度,如果够用建议支持官方服务。
  • 如果只需要为固定文本生成语音,可以使用有声内容创作工具。

核心亮点

  • 无需 Azure 密钥,开箱即用,零成本接入高质量 TTS
  • 支持多语言和多种神经语音,音质自然,接近真人
  • 提供简洁 REST API,支持 SSML 和参数调节,集成方便

不足之处

  • 依赖微软非官方接口,可能因上游变动而失效
  • 文档和示例相对简单,高级用法需自行探索

适用场景

  • 个人开发者快速为应用添加语音播报功能
  • 教育类工具生成语音朗读内容
  • 自动化流程中生成语音提示或配音

替代项目

edge-tts、pyttsx3、gTTS

项目介绍

ms-ra-forwarder 是音频音乐领域的开源项目,由 wxxxcxx 开发,2022 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(1,058)位列前 30%,在音频音乐分类中处于中上游。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-14。免费在线文本转语音API,无付费版本。从国内网络环境看,当前已无法正常访问。

它主要面向的使用场景是:个人开发者快速为应用添加语音播报功能。同类可对比的替代方案包括 edge-tts、pyttsx3、gTTS。

上一篇:ComfyUI-EdgeTTS

下一篇:M3-TTS

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09