vocotype-cli

按快捷键说话,文字自动输入到当前应用,本地运行不上传。

VocoType 是一款本地端侧运行的隐私安全语音输入工具,通过全局快捷键即可将语音实时转成文字并自动输入到当前应用,无需手动复制粘贴。它基于 FunASR 等语音识别技术,核心解决在任意软件中快速输入文字的问题,尤其适合不便打字或追求效率的场景。主要能力包括:语音转文字并自动上屏、支持 MCP 协议让 AI 助手调用语音识别、AI 优化文本(润色、纠错、格式化)、自定义替换词典(把口头语映射为固定短语)、以及录音和视频文件转文字。所有识别在本地完成,不上传云端,兼顾隐私与低延迟。项目用 Python 编写,提供命令行交互方式,适合开发者、写作者、客服等需要高频输入文字的用户,也方便集成到自己的工具链中。

开源 unknown 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 941
维护状态 活跃
是否开源
定价模式 unknown

项目数据

分类语音识别
开发团队233stone
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源
开源协议NOASSERTION
主要语言Python
技术栈/模型asr,funasr
GitHub 星标★ 941
30天Star增速
HF 下载量
上线时间2025-10-13 00:00:00
最近更新2026-09-18 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-16
浏览次数0

使用教程

核心亮点

  • 本地端侧识别,语音数据不出本机,隐私安全
  • 全局快捷键触发并自动上屏,可在任意应用中使用,无需切换窗口
  • 支持自定义替换词典和 AI 文本优化,能按个人习惯修正识别结果

不足之处

  • 早期项目,文档和社区生态还在完善中
  • 依赖 FunASR 等模型,首次使用需下载模型且对本地算力有一定要求

适用场景

  • 写代码或写文档时用语音快速输入大段文字
  • 客服或运营人员在不方便打字的场景下快速回复消息
  • 将会议录音、视频文件批量转成文字稿

替代项目

Buzz、whisper.cpp、Vosk

项目介绍

vocotype-cli 是一个语音识别领域的开源项目,官方简介:VocoType 是一款运行在本地端侧的隐私安全语音输入工具,通过快捷键即可将语音实时转换为文字并自动输入到当前应用。支持语音转文字MCP、AI 优化文本、自定义替换词典、录音视频转文字等功能,让语音输入更高效、更安全。。项目使用 Python 开发,在 GitHub 上获得 935 星标。

上一篇:docker-whisper

下一篇:auto-caption

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1613 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3713 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11823 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5649 2026-08-13