Hex

在 Mac 上本地快速把语音变成文字,保护隐私又高效。

Hex 是一款专为 macOS 打造的语音转文字工具,基于 Swift 和 SwiftUI 构建,核心目标是实现从语音到文字的快速、精准转换。它利用 OpenAI 的 Whisper 模型进行本地转录,无需上传音频到云端,保障了用户隐私。Hex 解决了传统语音转文字工具依赖网络、延迟高、隐私泄露风险大的问题,提供了高效的本地转录能力。其核心能力包括实时录音转写、音频文件导入转写、以及通过 Composable Architecture 构建的稳定、可维护的代码架构。用户可以通过简单的操作,将会议录音、采访音频、课堂讲座等快速转化为可编辑的文本,极大提升信息处理效率。Hex 界面简洁,交互流畅,是 macOS 用户进行语音笔记、内容整理和辅助输入的得力工具。

开源 unknown 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 2898
维护状态 较活跃
是否开源 是
定价模式 unknown

项目数据

分类语音识别
开发团队kitlangton
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议MIT
主要语言Swift
技术栈/模型composable-architecture,macos,swift,swiftui,transcription,whisper
GitHub 星标★ 2898
30天Star增速
HF 下载量
上线时间2025-01-27 00:00:00
最近更新2026-09-23 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-10
浏览次数8

使用教程

难度:入门 约 5 分钟 部署方式:本地安装 7 步

环境要求

  • macOS 系统,且为 Apple Silicon(M 系列芯片)Mac,暂不支持 Intel 机型
  • 若走 Homebrew 安装,需已安装 Homebrew
  • 需要授予麦克风权限(录音)
  • 需要授予辅助功能权限(将转录文字粘贴到其他应用)
  • 本机需有足够空间存放本地语音模型(WhisperKit / Parakeet TDT v3,按需下载)

安装与启动步骤

  1. 1确认硬件兼容

    Hex 的 Swift 版本目前只在 Apple Silicon Mac 上可用,先确认自己的机器是 M 系列芯片,Intel 机型无法运行。

  2. 2安装 Hex 应用

    推荐用 Homebrew 一条命令安装;也可从 README 给出的官方 S3 链接下载 dmg(hex-latest.dmg)后拖入「应用程序」文件夹。

    brew install --cask kitlangton-hex
  3. 3授予麦克风权限

    首次打开 Hex 时会弹出权限请求,允许麦克风,否则无法录制语音。

  4. 4授予辅助功能权限

    再允许辅助功能权限,否则转录出的文字无法自动粘贴到当前正在输入的任意应用中。

  5. 5配置全局热键

    在应用内设置一个全局热键,用于在任何界面下随时触发录音。

  6. 6按住热键转录

    按住热键开始录音,说完松开热键,即开始转录并自动粘贴结果。

  7. 7双击热键锁定录音

    双击热键可锁定录音而无需一直按住,说完后再按一次热键结束并触发转录。

关键配置

配置项必填说明示例
全局热键是触发录音与转录的快捷键,可按使用习惯自定义自定义组合键

如何确认成功

打开 Hex 并完成两项权限授权后,设置好热键,按住热键说一句话,松开后当前光标处应出现转录文字。

常见问题

Q:Intel 芯片的 Mac 能用吗?

A:不能。README 明确说明 Hex 目前仅支持 Apple Silicon Mac。

Q:音频会上传到云端吗?

A:不会。Swift 版本通过 FluidAudio(Parakeet TDT v3)和 WhisperKit 在设备本地完成转录。

Q:这个仓库还在更新吗?

A:原 Swift 应用已归档保留,作者用 Rust 重写了 Hex,新源码在 anomalyco/hex,官网 hex.kitlangton.com 可试新版。

Q:装了却无法自动粘贴文字?

A:检查系统设置中是否已为 Hex 开启辅助功能权限;仅授权麦克风不足以完成粘贴。

注意事项

  • 本项目已迁移:此仓库仅保留原 Swift 应用、历史与发布版本,新版本为 Rust 重写版
  • Hex 仅支持 Apple Silicon Mac
  • 安装来源为 Homebrew cask 或官方 S3 下载链接,勿使用第三方渠道
  • 本地转录依赖设备端模型,首次使用可能需要下载模型文件

核心亮点

  • 完全本地转录,音频不上传,隐私安全有保障
  • 基于 Whisper 模型,识别准确率高,支持多语言
  • SwiftUI 界面原生流畅,操作简单易上手

不足之处

  • 仅支持 macOS 平台,覆盖用户群有限
  • 对 Mac 硬件性能有一定要求,老旧设备可能运行卡顿
  • 文档/社区待观察

适用场景

  • 记者或内容创作者快速整理采访录音为文字稿
  • 学生将课堂讲座或会议录音转为笔记
  • 播客或视频创作者将音频素材转为字幕或文案

替代项目

Whisper Transcription、MacWhisper、Superwhisper

项目介绍

Hex 是语音识别领域的开源项目,由 kitlangton 开发,2025 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(2,898)位列前 30%,在语音识别分类中处于中上游。

近 42 天,它的 GitHub 星标从 2,825 增加到 2,898,净增 73。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-23。从国内网络环境看,可直接访问。

它主要面向的使用场景是:记者或内容创作者快速整理采访录音为文字稿。同类可对比的替代方案包括 Whisper Transcription、MacWhisper、Superwhisper。

上一篇:speaches

下一篇:OpenSuperWhisper

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13