OmniDictate 是语音识别领域的开源项目,由 gurjar1 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 153。
项目仍在小幅维护中,最近一次代码更新于 2026-08-31。完全免费的开源本地实时听写工具,无云服务,无付费版本。
它主要面向的使用场景是:办公场景下快速记录会议或邮件内容。同类可对比的替代方案包括 Whisper Desktop、Speech Note、Vibe。

本地实时语音打字,隐私安全,直接输入任何应用。
OmniDictate 是一款免费开源的 Windows 实时听写工具,完全本地运行,无需云端,保护隐私。它利用 faster-whisper 等 AI 模型实现语音到文本的实时转换,并通过友好的图形界面将识别文字直接输入到任何应用程序中,如聊天窗口、文档编辑器等。该项目解决了用户在打字不便或需要高效输入时的痛点,提供低延迟、高准确率的语音输入体验。核心能力包括实时流式转录、本地推理、跨应用输入模拟,以及可自定义的快捷键和模型配置。它适用于办公、写作、编程等多种场景,是提升生产力的实用工具。
Whisper Desktop、Speech Note、Vibe
OmniDictate 是语音识别领域的开源项目,由 gurjar1 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 153。
项目仍在小幅维护中,最近一次代码更新于 2026-08-31。完全免费的开源本地实时听写工具,无云服务,无付费版本。
它主要面向的使用场景是:办公场景下快速记录会议或邮件内容。同类可对比的替代方案包括 Whisper Desktop、Speech Note、Vibe。
上一篇:bournemouth-forced-aligner
下一篇:megaphone
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper