spokestack-android

给安卓应用加上完整语音对话能力,唤醒、识别、理解、合成一步到位。

Spokestack Android 是一个面向 Android 平台的可扩展移动语音框架,旨在帮助开发者快速为应用集成完整的语音交互能力。它涵盖唤醒词检测、自动语音识别(ASR)、自然语言理解(NLU)和文本转语音(TTS)四大核心模块,解决了从语音输入到语义理解再到语音输出的全链路问题。框架采用模块化设计,开发者可以根据需求灵活选用或替换各组件,并支持自定义语音处理流水线。其核心能力包括:本地唤醒词引擎(如 Snowboy)、多种云端 ASR 服务接入(如 Google、Azure)、基于上下文的 NLU 意图解析,以及流畅的 TTS 合成。项目使用 Java 编写,提供简洁的 API 和示例代码,适合希望快速为应用添加语音交互的 Android 开发者。作为早期项目,它更注重框架的完整性和可扩展性,为移动端语音应用开发提供了统一的解决方案。

开源 unknown 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 74
维护状态 低维护
是否开源 是
定价模式 unknown

项目数据

分类音频音乐
开发团队spokestack
所属国家
定价模式unknown
价格说明官网存在但定价信息不明确,需进一步确认。
访问状态
是否开源是
开源协议Apache-2.0
主要语言Java
技术栈/模型android,asr,natural-language-understanding,nlu,speech,speech-api,speech-recognition,speech-synthesis,text-to-speech,tts,vad,voice,voice-activity-detection,voice-as-an-interface,voice-assistant,voice-recognition,voice-synthesis,wakeword,wakeword-activation
GitHub 星标★ 74
30天Star增速
HF 下载量
上线时间2018-03-01 00:00:00
最近更新2025-12-28 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数5

使用教程

核心亮点

  • 模块化设计,唤醒词、ASR、NLU、TTS 可独立替换,灵活适配不同语音服务
  • 内置本地唤醒词引擎,支持离线触发,降低延迟和隐私风险
  • 提供统一 API 和示例,能快速集成到现有 Android 项目,减少开发成本

不足之处

  • 项目星标较少,社区活跃度和文档完善度有待观察
  • 云端服务依赖第三方配置,可能增加接入复杂度

适用场景

  • 为智能家居控制应用添加语音唤醒和指令识别
  • 在车载或可穿戴设备中实现免提语音交互
  • 构建语音助手类应用,需要完整的语音对话闭环

替代项目

Picovoice、Snips、Android SpeechRecognizer

项目介绍

spokestack-android 是语音识别领域的开源项目,由 spokestack 开发,2018 年首次发布。

它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 74。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2025-12-28。官网存在但定价信息不明确,需进一步确认。从国内网络环境看,可直接访问。

它主要面向的使用场景是:为智能家居控制应用添加语音唤醒和指令识别。同类可对比的替代方案包括 Picovoice、Snips、Android SpeechRecognizer。

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13