vibe

本地录音秒变文字,隐私不泄露

vibe 是一款基于 OpenAI Whisper 的本地语音转文字桌面应用,支持 macOS、Windows 和 Linux。它解决了用户需要快速、私密地将语音转换为文本的需求,无需将音频上传到云端。核心能力包括:实时录音转写、批量音频文件转录、多语言支持、自动保存转录历史、可自定义 Whisper 模型大小以平衡速度与精度。应用采用 Rust 和 TypeScript 构建,界面简洁,操作流畅,适合会议记录、访谈整理、内容创作等场景。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 7587
维护状态 较活跃
是否开源 是
定价模式 free

项目数据

分类语音识别
开发团队thewh1teagle
所属国家
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型ai,cross-platform,desktop,openai,rust,transcribe,whisper
GitHub 星标★ 7587
30天Star增速
HF 下载量
上线时间2024-01-08 00:00:00
最近更新2026-09-22 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-10
浏览次数7

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 6 步

⚠ 该项目 README 未提供完整安装说明,以下步骤为通用流程,请以官方文档为准。

环境要求

  • macOS、Windows 或 Linux 桌面系统(官方提供三平台版本)
  • 可访问官网下载页 https://thewh1teagle.github.io/vibe/ 获取安装包
  • 使用转录摘要功能时需准备 Claude API Key(可选)
  • 进行本地 AI 分析或批量摘要时需本机已安装 Ollama(可选)

安装与启动步骤

  1. 1打开官网下载页

    访问 Vibe 官方网站下载页,页面顶部提供 Download Vibe 入口;README 未给出任何命令行安装方式。

  2. 2下载对应平台安装包

    在下载页按自己的操作系统(macOS / Windows / Linux)选择并下载安装包,README 未说明具体文件名与版本。

  3. 3安装并启动应用

    运行下载的安装包完成安装,然后打开 Vibe。应用支持自动更新,后续版本无需手动重装。

  4. 4选择模型与音源

    在应用内选择模型(支持 Whisper、Nemotron 3.5、Parakeet TDT v3)并导入音频或视频文件,也可进行实时录音。

  5. 5开始转录并预览

    执行转写,界面提供实时预览;支持批量转录多个文件,几乎覆盖所有语言,可翻译为英语。

  6. 6导出或打印结果

    转录完成后可导出为 SRT、VTT、TXT、HTML、PDF、JSON、DOCX,也可直接打印,并支持自动保存历史。

关键配置

配置项必填说明示例
Claude API Key否启用转录摘要功能时需要,用于获取多语言摘要sk-xxxxxxxx

如何确认成功

应用成功打开,能导入音频文件并看到实时转录预览,即为正常运行。

常见问题

Q:转录时音频会上传到云端吗?

A:不会。Vibe 完全离线转录,数据不会离开你的设备,隐私性最强。

Q:支持哪些语言?

A:几乎支持所有语言,并且可以把任意语言的转录结果翻译成英文。

Q:可以用哪些语音模型?

A:支持 Whisper、Nemotron 3.5 和 Parakeet TDT v3 三种模型。

Q:转录结果能导出成什么格式?

A:支持 SRT、VTT、TXT、HTML、PDF、JSON、DOCX 七种格式,也可直接打印。

Q:没有网络能用吗?

A:可以。转录功能完全在本地进行,无需联网,联网主要用于自动更新。

注意事项

  • README 未提供 pip、npm、cargo、docker 等安装命令,唯一官方途径是从官网下载桌面安装包,请勿轻信第三方安装方式。
  • 应用为桌面客户端,安装后图形界面操作即可,无需配置命令行环境。
  • 摘要功能依赖 Claude API,本地分析可选择 Ollama,两者均为可选项。
  • 支持从 YouTube、Vimeo、Facebook、Twitter 等网站转录音频。

核心亮点

  • 完全本地运行,音频不上传,隐私安全
  • 支持实时录音和批量文件转录,效率高
  • 跨平台桌面应用,界面简洁易用

不足之处

  • 首次运行需下载模型,占用磁盘空间
  • 长音频转录速度受限于本地硬件

适用场景

  • 会议纪要快速生成
  • 访谈录音文字整理
  • 播客/视频字幕制作

替代项目

whisper.cpp、faster-whisper、Buzz

项目介绍

vibe 是语音识别领域的开源项目,由 thewh1teagle 开发,2024 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(7,587)位列前 7%,在语音识别分类的 212 个项目里位列前 10%。

近 41 天,它的 GitHub 星标从 7,067 增加到 7,587,净增 520。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-22。MIT许可证,完全免费,可自行部署使用。

它主要面向的使用场景是:会议纪要快速生成。同类可对比的替代方案包括 whisper.cpp、faster-whisper、Buzz。

上一篇:buzz

下一篇:openwhispr

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13