transcribe.cpp

本地跑 16 种语音识别模型,离线转文字又快又省

transcribe.cpp 是一个基于 ggml 的语音识别推理库,支持 16 种以上主流 ASR 模型家族的本地部署。它解决了语音识别模型在不同硬件上高效运行的问题,通过 GGUF 格式统一模型表示,提供跨平台(CPU/GPU)的轻量级推理能力。核心能力包括:多模型支持(如 Whisper、Distil-Whisper 等)、低内存占用、无外部依赖的纯 C++ 实现,以及简单的命令行接口。项目面向开发者,方便集成到边缘设备或桌面应用中,实现离线、实时的语音转文字。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1811
维护状态 活跃
是否开源
定价模式 free

项目数据

分类语音识别
开发团队handy-computer
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源
开源协议MIT
主要语言C++
技术栈/模型asr,ggml,gguf,speech-to-text
GitHub 星标★ 1811
30天Star增速
HF 下载量
上线时间2026-04-07 00:00:00
最近更新2026-08-19 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-10
浏览次数0

核心亮点

  • 支持 16+ 模型家族,覆盖 Whisper 全系列及变体,选择灵活
  • 基于 ggml 优化,CPU 上推理速度快,内存占用低,适合边缘部署
  • 纯 C++ 无重依赖,编译简单,易于嵌入其他项目

不足之处

  • 文档相对简略,高级用法需读源码
  • GPU 加速支持有限,主要优化集中在 CPU

适用场景

  • 在树莓派等低功耗设备上做离线语音助手
  • 桌面应用内嵌实时语音转写功能
  • 隐私敏感场景下本地批量音频转文字

替代项目

whisper.cpp、faster-whisper、whisper-jax

项目介绍

transcribe.cpp 是一个语音识别领域的开源项目,官方简介:ggml speech-to-text inference for 16+ model families。项目使用 C++ 开发,在 GitHub 上获得 1728 星标。

上一篇:AudioNotes

下一篇:amical

同类项目推荐

LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3548 2026-08-10
espnet 开源

语音识别、合成、翻译一把抓,一个工具箱全搞定

End-to-End Speech Processing Toolkit

★ 9928 2026-08-09
speaches 开源

一键部署,即刻拥有 OpenAI 兼容的语音转文字服务

★ 3602 2026-08-10
cheetah 开源

在设备上实时把语音转文字,离线低延迟还保护隐私

On-device streaming speech-to-text engine powered by deep learning

★ 670 2026-08-10