whisper.rn

手机端离线跑 Whisper,语音转文字不联网

whisper.rn 是 whisper.cpp 的 React Native 绑定库,让移动端应用可以直接在设备上运行 OpenAI Whisper 语音识别模型,无需联网调用云端 API。它解决了移动端离线语音转文字的需求:开发者用 TypeScript 调用统一接口,即可在 iOS/Android 上完成音频转写、实时流式识别、多语言翻译等任务。核心能力包括:支持多种量化模型(tiny 到 large),可自定义模型路径与下载;提供 transcribe、transcribeRealtime 等 API,支持 VAD 语音活动检测、进度回调和取消操作;底层复用 whisper.cpp 的 C/C++ 推理性能,兼容 Metal、Core ML 等加速后端。项目还附带示例 App,方便快速验证效果。对于注重隐私、低延迟、无网络环境的语音应用(如会议记录、字幕生成、语音助手)是较实用的方案。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 802
维护状态 活跃
是否开源
定价模式 free

项目数据

分类语音识别
开发团队mybigday
所属国家
官网地址
定价模式free
价格说明开源免费,基于MIT许可证
访问状态
是否开源
开源协议MIT
主要语言TypeScript
技术栈/模型openai,react-native,speech-recognition,whisper,whisper-cpp
GitHub 星标★ 802
30天Star增速
HF 下载量
上线时间2023-03-16 00:00:00
最近更新2026-09-17 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-23
浏览次数0

使用教程

核心亮点

  • 纯端侧推理,音频不出设备,隐私友好且无网络延迟
  • 提供实时流式识别与 VAD,适合连续语音场景
  • TypeScript 接口简洁,附带可运行示例 App,接入成本低

不足之处

  • 模型体积较大,低端设备内存与推理速度压力明显
  • 社区与文档相对早期,复杂定制问题排查依赖源码

适用场景

  • 离线会议记录与语音备忘录转文字
  • 移动端实时字幕/翻译工具
  • 隐私敏感场景下的语音输入法或助手

替代项目

whisper.cpp、Vosk、sherpa-onnx

项目介绍

whisper.rn 是语音识别领域的开源项目,由 mybigday 开发,2023 年首次发布。

在全站 12,961 个收录项目中,它的 GitHub 星标数(802)位列前 30%,在语音识别分类中处于中上游。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-17。开源免费,基于MIT许可证。

它主要面向的使用场景是:离线会议记录与语音备忘录转文字。同类可对比的替代方案包括 whisper.cpp、Vosk、sherpa-onnx。

上一篇:whisperX-FastAPI

下一篇:whisperIMEplus

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1614 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3733 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13