
vocotype-cli
按快捷键说话,文字自动输入到当前应用,本地运行不上传。
VocoType 是一款本地端侧运行的隐私安全语音输入工具,通过全局快捷键即可将语音实时转成文字并自动输入到当前应用,无需手动复制粘贴。它基于 FunASR 等语音识别技术,核心解决在任意软件中快速输入文字的问题,尤其适合不便打字或追求效率的场景。主要能力包括:语音转文字并自动上屏、支持 MCP 协议让 AI 助手调用语音识别、AI 优化文本(润色、纠错、格式化)、自定义替换词典(把口头语映射为固定短语)、以及录音和视频文件转文字。所有识别在本地完成,不上传云端,兼顾隐私与低延迟。项目用 Python 编写,提供命令行交互方式,适合开发者、写作者、客服等需要高频输入文字的用户,也方便集成到自己的工具链中。
开源
unknown
语音识别
GitHub 星标
★ 941
维护状态
活跃
是否开源
是
定价模式
unknown
项目数据
分类语音识别
开发团队233stone
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议NOASSERTION
主要语言Python
技术栈/模型asr,funasr
GitHub 星标★ 941
30天Star增速
HF 下载量
上线时间2025-10-13 00:00:00
最近更新2026-09-18 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-16
浏览次数0
使用教程
核心亮点
- 本地端侧识别,语音数据不出本机,隐私安全
- 全局快捷键触发并自动上屏,可在任意应用中使用,无需切换窗口
- 支持自定义替换词典和 AI 文本优化,能按个人习惯修正识别结果
不足之处
- 早期项目,文档和社区生态还在完善中
- 依赖 FunASR 等模型,首次使用需下载模型且对本地算力有一定要求
适用场景
- 写代码或写文档时用语音快速输入大段文字
- 客服或运营人员在不方便打字的场景下快速回复消息
- 将会议录音、视频文件批量转成文字稿
替代项目
Buzz、whisper.cpp、Vosk
项目介绍
上一篇:docker-whisper
下一篇:auto-caption
同类项目推荐
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper