moonshine

超低延迟语音全家桶,让语音交互快人一步

Moonshine 是一个专为语音代理和语音界面设计的超低延迟语音工具包,集成了语音转文字(STT)、意图识别和文字转语音(TTS)三大核心能力。它解决了传统语音流水线延迟高、组件分散的问题,通过统一的 C++ 实现和优化的推理引擎,将端到端语音交互延迟压缩到极低水平,适合实时对话场景。其核心能力包括:高效的流式 STT(支持实时转写)、轻量级意图分类(可直接从语音中识别用户意图)、以及自然流畅的 TTS 输出。项目采用 C++ 编写,强调性能与可移植性,支持多种平台部署,为开发者提供了构建语音助手、智能客服、语音控制等应用的完整基础组件。Moonshine 在 GitHub 上拥有超过 1 万星标,社区活跃,是语音 AI 领域值得关注的开源方案。

开源 unknown 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 11130
维护状态 较活跃
是否开源 是
定价模式 unknown

项目数据

分类音频音乐
开发团队moonshine-ai
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议NOASSERTION
主要语言C++
技术栈/模型intent-recognition,stt,tts,voice,voice-recognition
GitHub 星标★ 11130
30天Star增速
HF 下载量
上线时间2024-10-04 00:00:00
最近更新2026-09-22 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

难度:入门 约 5 分钟 部署方式:命令行工具 3 步

环境要求

  • 已安装 Python 与 pip(通过 pip 安装 moonshine-voice 包)
  • 可用的麦克风等音频输入设备(mic 命令用于实时采集语音)
  • 无需账号或 API 密钥,全部在设备本地运行

安装与启动步骤

  1. 1安装 Moonshine

    用 pip 安装官方发布的 moonshine-voice 包,安装完成后即可使用同名命令行工具。

    pip install moonshine-voice
  2. 2启动麦克风转写

    运行 mic 子命令并从麦克风拾音,用 --language 指定识别语言,如 en 表示英语。

    moonshine-voice mic --language en
  3. 3可选:接入编码代理

    如果用编码代理写代码,可添加官方 skill,让代理了解当前 API 用法,避免误用旧接口。

    npx skills add moonshine-ai/moonshine --skill moonshine-voice

关键配置

配置项必填说明示例
--language否指定语音识别使用的语言代码en

如何确认成功

命令行未报错并进入麦克风监听状态、终端出现实时转写结果,即表示安装与启动成功。

常见问题

Q:安装后提示找不到 moonshine-voice 命令怎么办?

A:确认 pip 对应的 Python 环境与当前终端一致,可先用 pip show moonshine-voice 检查是否装成功,再重新执行 pip install moonshine-voice。

Q:运行时没有识别结果或提示音频相关错误?

A:mic 命令需要麦克风输入,请确认系统已连接麦克风、终端有录音权限,且没有被其他程序独占。

Q:需要申请 API Key 或联网上传音频吗?

A:不需要。README 说明全部在设备本地运行,速度快、隐私性好,无需账号或 API 密钥。

Q:Python 之外的平台怎么用?

A:官方 Quickstart 覆盖 Python、JavaScript/WASM、iOS、Android、macOS、Linux、Windows 和树莓派,详见 moonshine-voice.readthedocs.io。

注意事项

  • 所有推理都在设备本地完成,无需账号或 API 密钥。
  • 其他平台安装方式与可运行示例见官方文档 moonshine-voice.readthedocs.io 的 Quickstart 与 Examples。
  • 使用编码代理时也可手动把 .agents/skills/moonshine-voice/ 复制到项目的 .agents/skills/ 目录。

核心亮点

  • 端到端延迟极低,实测语音转写响应速度优于主流方案,适合实时对话
  • 一体化集成 STT、意图识别、TTS,免去多组件拼装和调优成本
  • C++ 实现,内存占用小,支持边缘设备部署,性能稳定

不足之处

  • 文档相对简略,部分高级用法需自行阅读源码
  • 模型生态较新,预训练模型覆盖语种有限,中文支持待加强

适用场景

  • 构建实时语音助手(如智能音箱、车载语音)
  • 开发低延迟语音客服机器人,提升交互流畅度
  • 用于语音控制界面(如无障碍辅助、工业语音指令)

替代项目

Whisper.cpp、Vosk、Coqui TTS

项目介绍

moonshine 是语音识别领域的开源项目,由 moonshine-ai 开发,2024 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(11,130)位列前 5%,在语音识别分类的 212 个项目里位列前 6%。

近 44 天,它的 GitHub 星标从 10,710 增加到 11,130,净增 420。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-22。从国内网络环境看,可直接访问。

它主要面向的使用场景是:构建实时语音助手(如智能音箱、车载语音)。同类可对比的替代方案包括 Whisper.cpp、Vosk、Coqui TTS。

上一篇:deepgram-dotnet-sdk

下一篇:PaddleSpeech

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13