speech-android

高通芯片上跑离线语音,识别降噪一次搞定

speech-android 是一个面向 Android 平台的端侧语音 SDK,基于 ONNX Runtime 并利用高通 NNAPI 加速,提供语音识别(ASR)、文本转语音(TTS)、语音活动检测(VAD)和噪声抑制等核心功能。它专为边缘计算场景设计,尤其针对高通骁龙平台优化,支持汽车、移动设备等离线环境下的语音交互。项目采用 Kotlin 编写,模块化架构,开发者可将其集成到应用中,实现低延迟、高隐私的本地语音处理,无需依赖云端服务。该 SDK 解决了端侧语音处理中常见的性能瓶颈和网络依赖问题,通过硬件加速提升实时性,适合对数据安全和响应速度有严格要求的应用场景。

开源 unknown 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 159
维护状态 活跃
是否开源 是
定价模式 unknown

项目数据

分类音频音乐
开发团队soniqo
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议Apache-2.0
主要语言Kotlin
技术栈/模型android,asr,automotive,edge-ai,kotlin,nnapi,on-device,onnx-runtime,qualcomm,snapdragon,speech-enhancement,speech-recognition,text-to-speech,tts,voice-activity-detection,voice-agent
GitHub 星标★ 159
30天Star增速
HF 下载量
上线时间2026-03-18 00:00:00
最近更新2026-09-21 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

核心亮点

  • 专为高通骁龙优化,NNAPI 加速让 ASR/TTS 延迟更低
  • 集成 ASR、TTS、VAD、降噪四大功能,开箱即用
  • 纯端侧处理,保护隐私且无网络依赖,适合车载等场景

不足之处

  • 仅支持高通平台,其他芯片兼容性未知
  • 早期项目,文档和社区生态待观察

适用场景

  • 车载语音助手,离线指令识别
  • 移动应用内实时语音转文字
  • 嘈杂环境下的语音增强与识别

替代项目

Vosk、whisper.cpp、PocketSphinx

项目介绍

speech-android 是语音识别领域的开源项目,由 soniqo 开发,是 2026 年新上线的项目。

它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 159。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-21。

它主要面向的使用场景是:车载语音助手,离线指令识别。同类可对比的替代方案包括 Vosk、whisper.cpp、PocketSphinx。

上一篇:best-rq-pytorch

下一篇:AuxiliaryASR

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13