hyprwhspr

Linux 全局语音听写,按快捷键说话就出字

hyprwhspr 是一款面向 Linux 的原生语音转文字工具,目标是提供系统级、快速、准确且注重隐私的听写体验。它解决 Linux 桌面长期缺乏好用全局听写方案的问题:用户无需依赖云端服务,即可在任何应用里通过快捷键触发语音输入。核心能力包括系统级听写(不局限于某个编辑器或浏览器)、本地优先的语音识别(支持 Parakeet 等模型),并集成 Cohere、ElevenLabs 等可选后端,兼顾离线隐私与云端精度。项目用 Python 编写,针对 Arch、CachyOS、Debian、Fedora、openSUSE 等发行版做了适配,并与 Hyprland、Noctalia、Omarchy 等桌面环境深度整合。它强调可改造性,开发者可以替换识别引擎、调整快捷键与交互流程,适合追求隐私、效率和可定制性的 Linux 用户。

开源 unknown 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1200
维护状态 活跃
是否开源
定价模式 unknown

项目数据

分类语音识别
开发团队goodroot
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源
开源协议MIT
主要语言Python
技术栈/模型ai,archlinux,cachyos,cohere-ai,debian,dictation,elevenlabs,fedora,hyprland,noctalia,omarchy,opensuse,parakeet,speech-to-text,translation,ubuntu,waybar,wayland,whisper,x11
GitHub 星标★ 1200
30天Star增速
HF 下载量
上线时间2025-08-27 00:00:00
最近更新2026-09-16 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-17
浏览次数0

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 7 步

环境要求

  • Linux 系统(支持 Arch、Debian、Ubuntu、Fedora、openSUSE 等)
  • Arch 系发行版安装 AUR 包时需已安装 yay
  • 源码安装方式需能运行仓库内 scripts/ 与 bin/ 下的脚本(Python 编写)
  • 无独立 GPU 也可使用,onnx-asr 针对 CPU 做了优化

安装与启动步骤

  1. 1AUR 安装稳定版

    Arch 系发行版用 yay 从 AUR 安装稳定版 hyprwhspr,安装完成后即可使用 hyprwhspr 命令。

    yay -S hyprwhspr
  2. 2AUR 安装最新版

    想跟进最新代码可改装 bleeding edge 版本 hyprwhspr-git,二者择一安装即可,不要同时装。

    yay -S hyprwhspr-git
  3. 3运行交互式设置

    安装后必须运行 setup,按向导选择转录后端、下载模型,可选配置可视化与状态栏集成,并设置 systemd 用户服务与权限。

    hyprwhspr setup
  4. 4源码安装依赖

    从源码部署时,先在仓库根目录执行依赖安装脚本,为当前发行版装好所需依赖。

    git clone https://github.com/goodroot/hyprwhspr.git
    cd hyprwhspr
    ./scripts/install-deps.sh
  5. 5源码方式初始化

    依赖装好后,用仓库内的 bin 脚本运行交互式 setup,流程与 AUR 安装后一致。

    ./bin/hyprwhspr setup
  6. 6脚本式一键安装

    旧版 bootstrap 安装方式,也可直接用官网脚本安装,安装后同样要跑 setup。

    curl -fsSL https://hyprwhspr.com/install.sh | bash
  7. 7更新与重跑

    托管发布版用 update 命令升级;bootstrap 安装则重跑安装脚本。setup 是幂等的,可随时重跑。

    hyprwhspr update

如何确认成功

setup 流程最后一步会执行 Validate installation(验证安装),按提示确认通过即表示可用;也可随时重跑 hyprwhspr setup 验证。

常见问题

Q:必须联网或使用云服务吗?

A:不必须。转录默认在本机完成,数据不离开设备;Cohere、ElevenLabs、Gemini 等云端 API 均为完全可选。

Q:没有 GPU 能用吗?

A:可以。项目提供 onnx-asr,针对 CPU 做了速度优化,并支持限制甚至完全不占用 GPU 显存。

Q:支持哪些 Linux 发行版?

A:Arch、Debian、Ubuntu、Fedora、openSUSE 等均有支持;Arch 系可直接安装原生 AUR 包。

Q:如何更新到新版本?

A:托管发布版执行 hyprwhspr update;旧版 bootstrap 安装则重新运行 curl 安装脚本,之后可再跑一次 setup。

Q:setup 跑过一次还要再跑吗?

A:setup 是幂等的,重跑不会产生冲突,配置变更或验证安装时可以再次执行。

注意事项

  • AUR 的 hyprwhspr 为稳定版,hyprwhspr-git 为最新代码版,按需二选一。
  • 源码安装务必先执行 ./scripts/install-deps.sh,再运行 ./bin/hyprwhspr setup。
  • setup 会引导选择后端(Cohere Transcribe、Parakeet TDT V3、Whisper、Qwen3-ASR、REST API 或 Realtime WebSocket)并下载模型。
  • 托管发布版的升级与恢复细节见官方安装指南 docs/MANAGED_INSTALLATION.md。

核心亮点

  • 系统级全局听写,任意应用可触发,不局限于单一编辑器
  • 本地优先识别兼顾隐私,同时可接 Cohere、ElevenLabs 等云端后端
  • 深度适配 Hyprland 等 Linux 桌面生态,发行版覆盖广

不足之处

  • 主要面向 Linux 桌面,非 Linux 用户无法使用
  • 依赖特定桌面环境与音频配置,开箱体验可能需调试

适用场景

  • 在 Hyprland 桌面上用快捷键把口述内容直接输入到任意编辑器
  • 写代码或写文档时用语音快速记录想法,减少键盘输入
  • 对隐私敏感的用户在本地完成听写,不把语音上传云端

替代项目

nerd-dictation、whisper.cpp

项目介绍

hyprwhspr 是一个语音识别领域的开源项目,官方简介:Native speech-to-text for Linux - Fast, accurate, private, and hackable system-wide dictation。项目使用 Python 开发,在 GitHub 上获得 1200 星标。

上一篇:unmute

下一篇:没有了!

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1613 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3713 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11823 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5649 2026-08-13