
hyprwhspr
Linux 全局语音听写,按快捷键说话就出字
hyprwhspr 是一款面向 Linux 的原生语音转文字工具,目标是提供系统级、快速、准确且注重隐私的听写体验。它解决 Linux 桌面长期缺乏好用全局听写方案的问题:用户无需依赖云端服务,即可在任何应用里通过快捷键触发语音输入。核心能力包括系统级听写(不局限于某个编辑器或浏览器)、本地优先的语音识别(支持 Parakeet 等模型),并集成 Cohere、ElevenLabs 等可选后端,兼顾离线隐私与云端精度。项目用 Python 编写,针对 Arch、CachyOS、Debian、Fedora、openSUSE 等发行版做了适配,并与 Hyprland、Noctalia、Omarchy 等桌面环境深度整合。它强调可改造性,开发者可以替换识别引擎、调整快捷键与交互流程,适合追求隐私、效率和可定制性的 Linux 用户。
项目数据
使用教程
环境要求
- Linux 系统(支持 Arch、Debian、Ubuntu、Fedora、openSUSE 等)
- Arch 系发行版安装 AUR 包时需已安装 yay
- 源码安装方式需能运行仓库内 scripts/ 与 bin/ 下的脚本(Python 编写)
- 无独立 GPU 也可使用,onnx-asr 针对 CPU 做了优化
安装与启动步骤
-
1AUR 安装稳定版
Arch 系发行版用 yay 从 AUR 安装稳定版 hyprwhspr,安装完成后即可使用 hyprwhspr 命令。
yay -S hyprwhspr -
2AUR 安装最新版
想跟进最新代码可改装 bleeding edge 版本 hyprwhspr-git,二者择一安装即可,不要同时装。
yay -S hyprwhspr-git -
3运行交互式设置
安装后必须运行 setup,按向导选择转录后端、下载模型,可选配置可视化与状态栏集成,并设置 systemd 用户服务与权限。
hyprwhspr setup -
4源码安装依赖
从源码部署时,先在仓库根目录执行依赖安装脚本,为当前发行版装好所需依赖。
git clone https://github.com/goodroot/hyprwhspr.git cd hyprwhspr ./scripts/install-deps.sh -
5源码方式初始化
依赖装好后,用仓库内的 bin 脚本运行交互式 setup,流程与 AUR 安装后一致。
./bin/hyprwhspr setup -
6脚本式一键安装
旧版 bootstrap 安装方式,也可直接用官网脚本安装,安装后同样要跑 setup。
curl -fsSL https://hyprwhspr.com/install.sh | bash -
7更新与重跑
托管发布版用 update 命令升级;bootstrap 安装则重跑安装脚本。setup 是幂等的,可随时重跑。
hyprwhspr update
如何确认成功
setup 流程最后一步会执行 Validate installation(验证安装),按提示确认通过即表示可用;也可随时重跑 hyprwhspr setup 验证。
常见问题
Q:必须联网或使用云服务吗?
A:不必须。转录默认在本机完成,数据不离开设备;Cohere、ElevenLabs、Gemini 等云端 API 均为完全可选。
Q:没有 GPU 能用吗?
A:可以。项目提供 onnx-asr,针对 CPU 做了速度优化,并支持限制甚至完全不占用 GPU 显存。
Q:支持哪些 Linux 发行版?
A:Arch、Debian、Ubuntu、Fedora、openSUSE 等均有支持;Arch 系可直接安装原生 AUR 包。
Q:如何更新到新版本?
A:托管发布版执行 hyprwhspr update;旧版 bootstrap 安装则重新运行 curl 安装脚本,之后可再跑一次 setup。
Q:setup 跑过一次还要再跑吗?
A:setup 是幂等的,重跑不会产生冲突,配置变更或验证安装时可以再次执行。
注意事项
- AUR 的 hyprwhspr 为稳定版,hyprwhspr-git 为最新代码版,按需二选一。
- 源码安装务必先执行 ./scripts/install-deps.sh,再运行 ./bin/hyprwhspr setup。
- setup 会引导选择后端(Cohere Transcribe、Parakeet TDT V3、Whisper、Qwen3-ASR、REST API 或 Realtime WebSocket)并下载模型。
- 托管发布版的升级与恢复细节见官方安装指南 docs/MANAGED_INSTALLATION.md。
核心亮点
- 系统级全局听写,任意应用可触发,不局限于单一编辑器
- 本地优先识别兼顾隐私,同时可接 Cohere、ElevenLabs 等云端后端
- 深度适配 Hyprland 等 Linux 桌面生态,发行版覆盖广
不足之处
- 主要面向 Linux 桌面,非 Linux 用户无法使用
- 依赖特定桌面环境与音频配置,开箱体验可能需调试
适用场景
- 在 Hyprland 桌面上用快捷键把口述内容直接输入到任意编辑器
- 写代码或写文档时用语音快速记录想法,减少键盘输入
- 对隐私敏感的用户在本地完成听写,不把语音上传云端
替代项目
nerd-dictation、whisper.cpp
项目介绍
上一篇:unmute
下一篇:没有了!
同类项目推荐
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper