vocalinux

在 Linux 上说话就能打字,全程离线不联网

Vocalinux 是一款面向 Linux 桌面的免费开源离线语音听写工具,目标是在任何输入框中通过说话完成打字。它基于 whisper.cpp、OpenAI Whisper 和 VOSK 等语音识别引擎,支持 GPU 加速,兼容 X11 与 Wayland 两种显示协议,数据全程本地处理,不上传云端,适合注重隐私的用户。项目用 Python 编写,通过系统级输入注入把识别结果直接送入当前焦点窗口,因此浏览器、编辑器、终端等场景都能用。核心能力包括多引擎切换、离线转写、快捷键触发听写、GPU 加速降低延迟,以及对主流 Linux 桌面环境的适配。它解决的是 Linux 平台长期缺乏好用、隐私友好听写方案的问题,让不想依赖在线语音服务的用户也能高效口述文字。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 860
维护状态 活跃
是否开源
定价模式 free

项目数据

分类语音识别
开发团队VocaHQ
所属国家
定价模式free
价格说明完全免费开源,官网可下载使用
访问状态
是否开源
开源协议AGPL-3.0
主要语言Python
技术栈/模型accessibility,dictation,gpu-acceleration,linux,offline-first,privacy-first,python,speech-recognition,speech-to-text,voice,voice-typing,vosk,wayland,whisper,whisper-cpp
GitHub 星标★ 860
30天Star增速
HF 下载量
上线时间2025-04-12 00:00:00
最近更新2026-09-22 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-23
浏览次数0

使用教程

核心亮点

  • 支持 whisper.cpp、Whisper、VOSK 多引擎切换,可按精度或速度取舍
  • 100% 本地离线运行,语音数据不出本机,隐私友好
  • 同时兼容 X11 和 Wayland,并支持 GPU 加速降低转写延迟

不足之处

  • 项目较新、星标约 860,文档与社区生态仍在早期阶段
  • 依赖本地模型与 GPU 配置,低配机器上识别速度和准确率可能受限

适用场景

  • 在 Linux 桌面任意输入框口述邮件、文档或聊天内容
  • 程序员在终端或编辑器里用语音快速写注释和提交信息
  • 注重隐私的用户在无网络或不愿上传语音的环境下做听写

替代项目

whisper.cpp、nerd-dictation

项目介绍

vocalinux 是语音识别领域的开源项目,由 VocaHQ 开发,2025 年首次发布。

在全站 12,961 个收录项目中,它的 GitHub 星标数(860)位列前 30%,在语音识别分类中处于中上游。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。完全免费开源,官网可下载使用。

它主要面向的使用场景是:在Linux桌面任意输入框口述邮件、文档或聊天内容。同类可对比的替代方案包括 whisper.cpp、nerd-dictation。

上一篇:DictateKeyboard

下一篇:OpenWhisper

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1614 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3733 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13