FunSpeech

本地一键部署语音识别与合成,秒级搭建私有语音服务

FunSpeech 是一个面向本地私有化部署的语音服务工具,旨在简化语音识别(ASR)和语音合成(TTS)后端的搭建流程。它解决了开发者在使用 Qwen3ASR/FunASR 和 Qwen3TTS/CosyVoice 等模型时面临的配置复杂、依赖繁多、部署门槛高的问题。项目基于 Python 和 Docker 技术,提供开箱即用的服务,支持通过 WebSocket 进行实时语音交互,并兼容 CosyVoice 的多个版本。核心能力包括:快速启动语音识别与合成服务、支持多种模型后端切换、提供容器化部署方案以降低环境依赖成本。通过简单的配置和命令,用户即可在本地或私有环境中获得完整的语音处理能力,适用于需要数据隐私保护或离线场景的应用。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 163
维护状态 维护中
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队zaigie
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,本地私有化部署,完全免费。
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型asr,cosyvoice,cosyvoice2,cosyvoice3,docker,funasr,qwen3-asr,qwen3-tts,tts,websocket-chat
GitHub 星标★ 163
30天Star增速
HF 下载量
上线时间2025-08-27 00:00:00
最近更新2026-09-09 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数5

使用教程

核心亮点

  • 基于 Docker 容器化,环境依赖隔离,部署简单快速
  • 同时支持 Qwen3ASR/FunASR 和 Qwen3TTS/CosyVoice 多模型,灵活切换
  • 提供 WebSocket 接口,便于集成实时语音交互应用

不足之处

  • 项目早期,社区和文档有待完善
  • 依赖特定模型版本,升级或扩展可能需自行适配

适用场景

  • 企业内网部署语音助手,保障数据隐私
  • 快速搭建语音交互原型,验证产品功能
  • 离线环境下的语音转写与合成服务

替代项目

FunASR、CosyVoice、whisper.cpp

项目介绍

FunSpeech 是语音识别领域的开源项目,由 zaigie 开发,2025 年首次发布。

它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 163。

项目仍在小幅维护中,最近一次代码更新于 2026-09-09。MIT许可证,本地私有化部署,完全免费。

它主要面向的使用场景是:企业内网部署语音助手,保障数据隐私。同类可对比的替代方案包括 FunASR、CosyVoice、whisper.cpp。

上一篇:EasyMrcp

下一篇:Easy-Voice-Toolkit

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13