Handy

完全离线、免费开源的语音转文字工具,保护隐私,即开即用。

Handy 是一款免费、开源、可扩展的离线语音转文字应用,基于 Rust 和 Tauri v2 构建,支持跨平台运行。它利用操作系统自带的语音识别引擎(如 Windows Speech Recognition、macOS Speech Framework 等),无需联网即可将语音实时转换为文字,有效保护用户隐私。Handy 提供系统级全局快捷键,可随时启动/停止听写,并支持自定义快捷键和命令,方便用户在不同应用中快速输入。其核心能力包括:多语言识别、自动标点、自定义词汇表、以及通过插件扩展功能(如自动格式化、文本替换等)。Handy 解决了在线语音识别服务依赖网络、存在隐私泄露风险的问题,为需要高效文字输入的用户(如程序员、作家、残障人士)提供了安全、自由的本地解决方案。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 32036
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类语音识别
开发团队cjpais
所属国家
定价模式free
价格说明完全免费开源,离线运行,无付费版本。
访问状态
是否开源是
开源协议MIT
主要语言Rust
技术栈/模型accessibility,cross-platform,speech-to-text,tauri-v2
GitHub 星标★ 32036
30天Star增速
HF 下载量
上线时间2025-02-13 00:00:00
最近更新2026-09-22 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-10
浏览次数8

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 7 步

环境要求

  • 跨平台桌面系统(macOS 或 Windows)
  • 启动后需授予麦克风与辅助功能(accessibility)系统权限
  • 使用 Homebrew 或 winget 安装时,需已装好对应包管理器
  • 网络受限环境下,需要能通过浏览器访问模型下载地址

安装与启动步骤

  1. 1下载安装包

    从 GitHub releases 页面或官网 handy.computer 下载最新版本安装包,选择与自己系统对应的版本。

  2. 2macOS 用 Homebrew 装

    macOS 用户可用 Homebrew cask 一键安装。注意该 cask 包不由 Handy 开发者维护。

    brew install --cask handy
  3. 3Windows 用 winget 装

    Windows 用户可用 winget 安装。注意该包同样不由 Handy 开发者维护。

    winget install cjpais.Handy
  4. 4启动并授权

    启动 Handy,按提示授予麦克风和辅助功能权限,否则无法录音也无法把文字粘贴进其他应用。

  5. 5设置快捷键

    在 Settings 中配置你习惯的键盘快捷键,支持按住录音、点按切换等模式。

  6. 6手动装模型(可选)

    仅在代理或网络受限、无法自动下载模型时使用:把 .bin/.gguf 文件放进 models 目录,Parakeet 需解压后放整个目录。

  7. 7验证安装

    重启 Handy,打开 Settings → Models,确认模型显示为 Downloaded,选中后测试听写。

关键配置

配置项必填说明示例
{app_data_dir}/models/否手动安装模型的存放目录,.bin 与 .gguf 文件直接放入其中{app_data_dir}/models/ggml-small.bin
Parakeet 模型目录名否Parakeet 解压后的目录名必须与规范名称完全一致,否则无法识别parakeet-tdt-0.6b-v2-int8
键盘快捷键否在 Settings 中配置,用于启动/停止听写,可自定义按住录音或点按切换

如何确认成功

重启 Handy 后进入 Settings → Models,手动安装的模型显示为 "Downloaded",选用后能正常转写即成功。

常见问题

Q:Homebrew 和 winget 上的包是官方的吗?

A:不是。README 明确指出 Homebrew cask 与 winget 包均由第三方维护,不由 Handy 开发者维护,介意的话请从 releases 页面下载官方安装包。

Q:网络受限导致模型无法自动下载怎么办?

A:手动下载模型文件:Whisper 的 .bin 和 GGUF 的 .gguf 直接放进 models 目录,Parakeet 的 .tar.gz 解压后放入整个目录,然后重启 Handy。

Q:模型文件可以改名吗?

A:不可以。不要重命名 .bin 或 .gguf 文件,必须使用下载地址中的原始文件名;Parakeet 解压出的目录名也必须与规定名称完全一致。

Q:别的工具下载过的模型能复用吗?

A:可以。Handy 会识别共享的 Hugging Face 缓存目录 ~/.cache/huggingface/hub 中已存在的模型,无需再手动移动。

Q:放好模型后没有出现在列表里?

A:先检查文件名或目录名是否被改动,再完全重启 Handy,新放入的模型会在重启后被扫描识别。

注意事项

  • Homebrew cask 与 winget 包并非 Handy 开发者维护,优先考虑官方 releases 安装包
  • 必须授予麦克风和辅助功能权限,否则无法听写与粘贴文字
  • 手动安装模型后必须重启 Handy 才会被检测到
  • 需要自行从源码构建的用户请参阅仓库中的 BUILD.md 获取各平台构建要求

核心亮点

  • 完全离线运行,语音数据不出设备,隐私安全有保障
  • 基于系统原生识别引擎,无需额外配置,开箱即用
  • 支持自定义快捷键和命令,可深度融入个人工作流

不足之处

  • 识别准确率依赖操作系统自带引擎,可能不如云端服务
  • 高级功能(如自定义词汇表)配置相对复杂
  • 中文识别效果可能受系统引擎限制

适用场景

  • 在公共场合或隐私敏感环境中,安全地进行语音输入
  • 程序员、作家等需要长时间键盘输入的人群,用语音提效
  • 为肢体不便的用户提供无障碍输入方案

替代项目

Whisper (OpenAI)、Vosk、faster-whisper

项目介绍

Handy 是语音识别领域的开源项目,由 cjpais 开发,2025 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(32,036)位列前 2%,在语音识别分类的 212 个项目里位列前 2%。

近 41 天,它的 GitHub 星标从 29,367 增加到 32,036,净增 2,669。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。完全免费开源,离线运行,无付费版本。从国内网络环境看,可直接访问。

它主要面向的使用场景是:在公共场合或隐私敏感环境中,安全地进行语音输入。同类可对比的替代方案包括 Whisper (OpenAI)、Vosk、faster-whisper。

上一篇:typewhisper-mac

下一篇:LiveCaptions-Translator

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13