TheWhisper 是语音识别领域的开源项目,由 TheStageAI 开发,2025 年首次发布。
在全站 13,591 个收录项目中,它的 GitHub 星标数(898)位列前 30%,在语音识别分类中处于中上游。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-23。
它主要面向的使用场景是:本地实时字幕:会议、直播中边说话边生成文字。同类可对比的替代方案包括 whisper.cpp、faster-whisper。

让 Whisper 在本地设备上边听边转,低延迟出字幕
TheWhisper 是对 OpenAI Whisper 语音识别模型的工程化优化版本,专注于流式识别和端侧部署两大场景。原版 Whisper 虽然识别准确率高,但模型体积大、推理延迟高,难以在手机、笔记本等设备上实时运行。TheWhisper 针对不同硬件后端做了适配:在 Apple Silicon 上借助 CoreML 和 MLX 框架加速,在 NVIDIA GPU 上做推理优化,并支持流式分块解码,让音频边输入边出文字,而不是等整段录完再转写。项目用 Python 实现,覆盖实时字幕、会议记录、语音笔记等需要低延迟转写的用途,同时保留 Whisper 多语言识别能力。对于想在本地跑语音识别、又不想依赖云端 API 的开发者来说,它提供了开箱可用的优化方案,兼顾隐私与响应速度。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
—
whisper.cpp、faster-whisper
TheWhisper 是语音识别领域的开源项目,由 TheStageAI 开发,2025 年首次发布。
在全站 13,591 个收录项目中,它的 GitHub 星标数(898)位列前 30%,在语音识别分类中处于中上游。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-23。
它主要面向的使用场景是:本地实时字幕:会议、直播中边说话边生成文字。同类可对比的替代方案包括 whisper.cpp、faster-whisper。
上一篇:whisper-flow
下一篇:whisper.el
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper