qwen-scribe 是语音识别领域的开源项目,由 VladUZH 开发,是 2026 年新上线的项目。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 215。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。开源免费,本地运行无需付费。
它主要面向的使用场景是:会议或访谈录音的本地批量转写,避免上传云端。同类可对比的替代方案包括 whisper.cpp、faster-whisper、whisperX。

Mac 上离线语音转文字,说完即出字,音频不出本机
qwen-scribe 是一个面向 Apple Silicon Mac 的本地语音识别工具,基于 MLX 框架运行 Qwen3-ASR 模型,提供私有化、离线的转录与系统级听写能力。它解决的核心问题是:云端语音转文字服务存在隐私泄露风险、按量计费成本高、且离线场景不可用。项目将模型推理完全放在本机执行,音频不出设备,同时提供两种使用方式——一是对已有音频文件做批量转录,二是作为系统级听写工具,在任何输入框中通过快捷键唤起语音输入。核心能力包括:利用 Apple Silicon 的 Metal 与统一内存加速推理、支持长音频分段处理、提供命令行与常驻后台两种形态、可切换不同规模的 Qwen3-ASR 模型以平衡速度与准确率。适合对隐私敏感、经常需要会议记录或长文录入的用户。
whisper.cpp、faster-whisper、whisperX
qwen-scribe 是语音识别领域的开源项目,由 VladUZH 开发,是 2026 年新上线的项目。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 215。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。开源免费,本地运行无需付费。
它主要面向的使用场景是:会议或访谈录音的本地批量转写,避免上传云端。同类可对比的替代方案包括 whisper.cpp、faster-whisper、whisperX。
上一篇:typewhisper-win
下一篇:Diction
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper