voice-mcp-agent

克隆你的声音,让 AI Agent 开口说话

voice-mcp-agent 是一个基于 TypeScript 的开源语音 AI 代理项目,核心目标是把语音克隆、语音合成与 MCP(Model Context Protocol)代理连接起来。它让开发者可以用自定义音色驱动 AI Agent,实现“用某个人的声音说话”的交互体验。项目整合了 voice-cloner、voice-box 等能力,支持克隆目标音色并合成语音,再通过 MCP 协议把语音能力接入到各类智能体工作流中。适用场景包括语音助手、有声内容生成、客服机器人、角色配音等。项目目前处于早期阶段,星标约 137,技术栈围绕 mcp-agent 与 voice-agent 展开,适合想快速搭建“带自定义音色的语音智能体”的开发者参考和二次开发。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 137
维护状态 较活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类音频音乐
开发团队h1papc11
所属国家
官网地址
定价模式free
价格说明开源项目,免费使用,定价信息待确认
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型mcp-agent,voice-agent,voice-box,voice-cloner,voice-mcp
GitHub 星标★ 137
30天Star增速
HF 下载量
上线时间2026-06-26 00:00:00
最近更新2026-09-21 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-01
浏览次数0

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

使用教程

核心亮点

  • 把语音克隆、语音合成和 MCP Agent 串成一条链路,开箱即用
  • TypeScript 实现,前端/Node 开发者接入成本低
  • 围绕 MCP 协议设计,方便接入已有智能体生态

不足之处

  • 早期项目,文档和示例可能不完整
  • 语音克隆的合规与授权机制未见明确说明

适用场景

  • 给 AI 客服或助手配置专属音色
  • 为有声书、播客批量生成角色配音
  • 在 MCP 工作流中让 Agent 用自定义声音播报结果

替代项目

Coqui TTS、GPT-SoVITS

项目介绍

voice-mcp-agent 是音频音乐领域的开源项目,由 h1papc11 开发,是 2026 年新上线的项目。

它收录于音频音乐分类,该分类目前共有 757 个项目,GitHub 星标数为 137。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。免费使用。

它主要面向的使用场景是:给AI客服或助手配置专属音色。同类可对比的替代方案包括 Coqui TTS、GPT-SoVITS。

上一篇:remiqora

下一篇:piper1-gpl

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1241 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1413 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 250 2026-08-09