whisperIMEplus

安卓任意输入框,离线语音直接打字

whisperIMEplus 是一个基于 Whisper 语音识别模型的 Android 输入法(IME)项目,代码源自 RTranslator 的 Whisper 实现。它解决的核心问题是:在 Android 系统上,用户无需切换应用或依赖云端服务,就能在任意输入框内直接通过语音说话完成文字输入。项目以 Java 编写,打包为系统输入法,安装启用后即可在聊天、笔记、搜索等场景中调用。核心能力包括:本地离线运行 Whisper 模型,保护隐私且不依赖网络;通过输入法框架直接注入识别文本,兼容大多数 Android 应用;支持多语言识别(取决于所加载的 Whisper 模型)。对于需要快速口述、不便打字或注重隐私的用户,它提供了一种系统级、低门槛的语音输入方案。项目当前星标约 415,属于早期但方向明确的开源实现。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 415
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类语音识别
开发团队woheller69
所属国家
官网地址
定价模式free
价格说明开源免费,无在线服务
访问状态
是否开源
开源协议GPL-3.0
主要语言Java
技术栈/模型
GitHub 星标★ 415
30天Star增速
HF 下载量
上线时间2025-06-26 00:00:00
最近更新2026-09-22 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-23
浏览次数0

使用教程

核心亮点

  • 以系统输入法形式工作,可在任意 App 的输入框内直接语音输入,无需切换应用
  • 基于 Whisper 本地推理,语音数据不出设备,隐私性好且可离线使用
  • 代码源自 RTranslator 的 Whisper 实现,模型加载与推理逻辑相对成熟,便于二次开发

不足之处

  • 项目处于早期,文档和安装配置说明可能不够完善,新手部署门槛较高
  • 依赖 Whisper 模型文件,模型体积和推理速度对手机性能有一定要求

适用场景

  • 在聊天软件中不方便打字时,直接语音转文字发送消息
  • 在笔记或文档应用中口述记录灵感,避免手动输入
  • 在搜索框或表单中快速用语音填写内容,提升操作效率

替代项目

whisper.cpp、SherpaOnnx、Vosk

项目介绍

whisperIMEplus 是语音识别领域的开源项目,由 woheller69 开发,2025 年首次发布。

它收录于语音识别分类,该分类目前共有 192 个项目,GitHub 星标数为 415。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-22。开源免费,无在线服务。

它主要面向的使用场景是:在聊天软件中不方便打字时,直接语音转文字发送消息。同类可对比的替代方案包括 whisper.cpp、SherpaOnnx、Vosk。

上一篇:whisper.rn

下一篇:wyoming-faster-whisper

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1614 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3733 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13