Kaze

按住说话,松手出字,全程本地不联网

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 194
维护状态 活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类语音识别
开发团队fayazara
所属国家
官网地址
定价模式free
价格说明开源免费,本地运行无需付费
访问状态
是否开源是
开源协议MIT
主要语言Swift
技术栈/模型
GitHub 星标★ 194
30天Star增速
HF 下载量
上线时间2026-02-24 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-11
浏览次数0

项目介绍

Kaze 是一款面向 macOS 的本地语音转文字应用,用说话代替打字。它基于 Swift 开发,核心思路是把语音识别模型直接跑在用户设备上,音频不需要上传云端,从而兼顾隐私和低延迟。用户按住快捷键说话,松开后文字自动插入当前光标位置,可覆盖邮件、文档、聊天窗口等任意输入框。项目定位轻量、开箱即用,适合不想被订阅制云服务绑定、又希望日常口述输入的人群。作为早期项目,它目前星标约 194,功能聚焦在听写这一件事上,没有做会议记录、说话人分离等复杂能力。技术实现上依赖系统语音框架与本地模型,安装包体积和资源占用相对可控。整体而言,Kaze 解决的是“打字慢、懒得打字、又担心云端录音泄露”的痛点,用本地化换取隐私与响应速度,是 macOS 上本地听写工具的一个轻量选择。

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

核心亮点

  • 完全本地识别,音频不出设备,隐私敏感场景可用
  • 全局快捷键触发,文字直接插入当前光标,不打断工作流
  • Swift 原生开发,与 macOS 系统集成度高,启动和响应轻快

不足之处

  • 仅支持 macOS,Windows 和 Linux 用户无法使用
  • 早期项目,识别语言和自定义词库等能力可能有限,文档与社区待观察

适用场景

  • 写邮件或文档时用口述代替键盘输入
  • 在聊天软件中快速回复长消息
  • 不方便打字的场景下手持设备口述记录想法

替代项目

whisper.cpp、superwhisper

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1630 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3843 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11863 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5662 2026-08-13