OpenVoiceUI

一句话,让任何大模型和语音引擎变成你的实时语音助手

OpenVoiceUI 是一个开源的语音驱动 AI 助手平台,旨在通过语音交互连接任意大语言模型(LLM)和文本转语音(TTS)引擎,提供实时网页画布、音乐生成和智能体编排能力。它基于 Flask 构建,支持 Docker 和 Pinokio 一键部署,可完全自托管,解决用户在不同 AI 服务间切换繁琐、缺乏统一语音交互界面的问题。核心能力包括:语音识别与合成、多 LLM 适配、实时画布交互、音乐生成,以及通过 OpenClaw 进行多智能体任务编排。项目处于早期阶段(GitHub 星标 66),但架构清晰,安装简单(npx openvoiceui setup),适合开发者快速搭建个性化的语音 AI 工作台。

开源 unknown 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 75
维护状态 活跃
是否开源 是
定价模式 unknown

项目数据

分类音频音乐
开发团队MCERQUA
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议MIT
主要语言HTML
技术栈/模型ai-agent,ai-assistant,ai-canvas,ai-voice,docker,flask,llm,music-generation,openclaw,pinokio,self-hosted,speech-to-text,stt,text-to-speech,tts,voice-agent,voice-ai,voice-assistant,voice-interface
GitHub 星标★ 75
30天Star增速
HF 下载量
上线时间2026-02-25 00:00:00
最近更新2026-09-20 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

核心亮点

  • 支持任意 LLM 和 TTS 自由组合,避免厂商锁定
  • 内置实时画布和音乐生成,交互场景丰富
  • Docker/Pinokio 一键部署,自托管数据更安全

不足之处

  • 项目处于早期,文档和社区生态待观察
  • 语音交互延迟和稳定性需实际场景验证

适用场景

  • 开发者快速搭建个性化语音助手原型
  • 音乐创作者用语音生成旋律并实时编辑
  • 企业内网部署私有语音 AI 工作台

替代项目

OpenVoice、Mycroft、Rhasspy

项目介绍

OpenVoiceUI 是智能体领域的开源项目,由 MCERQUA 开发,是 2026 年新上线的项目。

它收录于智能体分类,该分类目前共有 2,499 个项目,GitHub 星标数为 75。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-20。从国内网络环境看,可直接访问。

它主要面向的使用场景是:开发者快速搭建个性化语音助手原型。同类可对比的替代方案包括 OpenVoice、Mycroft、Rhasspy。

上一篇:ZeusHammer

下一篇:mcp-tts

同类项目推荐

xinchao-dynamic-mind 开源

给 AI 装上疲惫和欲望,让交互更真实

独立、可自托管的 AI 动态心智状态引擎:驱动力、念头池、疲惫、睡眠与意图。

★ 199 2026-08-09
deepseek-harness 开源

把 AI 能力拆成乐高积木,拼出你的专属智能体。

DeepSeek Harness: Everything is a Plugin.

★ 233327 2026-08-15
AutoGPT 开源

开箱即用的 AI 员工,交代任务就自己干完

AutoGPT is the vision of accessible AI for everyone, to use and to build on. Our mis···

★ 187492 2026-08-09
EvoAgentX 开源

让 AI 智能体自己迭代变强,越用越聪明

EvoAgentX: Building a Self-Evolving Ecosystem of AI Agents

★ 3351 2026-09-12