
transcribe.cpp
本地跑 16 种语音识别模型,离线转文字又快又省
transcribe.cpp 是一个基于 ggml 的语音识别推理库,支持 16 种以上主流 ASR 模型家族的本地部署。它解决了语音识别模型在不同硬件上高效运行的问题,通过 GGUF 格式统一模型表示,提供跨平台(CPU/GPU)的轻量级推理能力。核心能力包括:多模型支持(如 Whisper、Distil-Whisper 等)、低内存占用、无外部依赖的纯 C++ 实现,以及简单的命令行接口。项目面向开发者,方便集成到边缘设备或桌面应用中,实现离线、实时的语音转文字。
开源
free
语音识别
GitHub 星标
★ 1811
维护状态
活跃
是否开源
是
定价模式
free
项目数据
分类语音识别
开发团队handy-computer
所属国家
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言C++
技术栈/模型asr,ggml,gguf,speech-to-text
GitHub 星标★ 1811
30天Star增速
HF 下载量
上线时间2026-04-07 00:00:00
最近更新2026-08-19 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-10
浏览次数0
核心亮点
- 支持 16+ 模型家族,覆盖 Whisper 全系列及变体,选择灵活
- 基于 ggml 优化,CPU 上推理速度快,内存占用低,适合边缘部署
- 纯 C++ 无重依赖,编译简单,易于嵌入其他项目
不足之处
- 文档相对简略,高级用法需读源码
- GPU 加速支持有限,主要优化集中在 CPU
适用场景
- 在树莓派等低功耗设备上做离线语音助手
- 桌面应用内嵌实时语音转写功能
- 隐私敏感场景下本地批量音频转文字
替代项目
whisper.cpp、faster-whisper、whisper-jax
项目介绍
上一篇:AudioNotes
下一篇:amical
同类项目推荐
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
espnet
开源
语音识别、合成、翻译一把抓,一个工具箱全搞定
End-to-End Speech Processing Toolkit
speaches
开源
一键部署,即刻拥有 OpenAI 兼容的语音转文字服务
cheetah
开源
在设备上实时把语音转文字,离线低延迟还保护隐私
On-device streaming speech-to-text engine powered by deep learning