obs-localvocal

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

obs-localvocal 是一个专为 OBS Studio 设计的本地语音识别与字幕插件,利用 OpenAI Whisper 等 AI 模型在本地实时将音频转为文字,并生成可自定义风格的字幕。它解决了直播或录制时依赖在线语音服务带来的延迟、隐私和成本问题,让主播、会议录制者等用户无需上传音频即可获得高精度字幕。核心能力包括实时转写、自动断句、字幕样式定制(字体、颜色、位置等)、多语言支持,以及通过 OBS 的源/过滤器系统无缝集成。插件基于 C++ 开发,性能优化良好,支持 GPU 加速,适合在直播、视频会议、无障碍内容制作等场景中提供即时的视觉辅助。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1613
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类语音识别
开发团队royshil
所属国家
定价模式free
价格说明开源免费,需自行编译安装。
访问状态
是否开源
开源协议GPL-2.0
主要语言C++
技术栈/模型ai,live-streaming,livestream,obs,obs-studio,obs-studio-plugin,openai-whisper,plugin,real-time-transcription,realtime-transcribe,realtime-translator,speech-recognition,speech-to-text,transcription,translation,whisper,whisper-cpp
GitHub 星标★ 1613
30天Star增速
HF 下载量
上线时间2023-08-10 00:00:00
最近更新2026-09-15 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-10
浏览次数13

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 6 步

环境要求

  • Windows 10/11(官方提供安装包)或 macOS/Linux(需按 README 构建或使用 flatpak 版 OBS)
  • 已安装 OBS Studio
  • 按显卡类型选择对应安装包:通用版、NVidia 版或 AMD 版
  • macOS 从源码构建时需要 Xcode/CMake 等构建环境(README 未列出完整依赖)

安装与启动步骤

  1. 1下载安装包

    打开项目 Releases 页面,Windows 用户按显卡选择 generic、nvidia 或 amd 版安装程序;Linux 表格在 README 中未完整显示,需自行到 Releases 查找。

  2. 2运行安装程序

    双击下载好的 obs-localvocal-0.6.2-windows-x64-*-Installer.exe,按向导完成安装,插件会被放入 OBS 插件目录。

  3. 3手动复制插件(macOS)

    构建完成后插件文件位于 ./release/Release,把生成的 .plugin 文件复制到 OBS 插件目录,例如 macOS 下的 Application Support/obs-studio/plugins。

    cp -r ./release/Release/obs-localvocal.plugin ~/Library/Application Support/obs-studio/plugins/
  4. 4打包 macOS 安装包

    README 给出的打包脚本示例;注意输出可能在 Release 文件夹而非 install 文件夹,需要时把 build_x86_64/Release 重命名为 build_x86_64/install。

    ./.github/scripts/package-macos -c Release
  5. 5启动 OBS Studio

    安装后从系统应用菜单启动 OBS;Linux 上如果是 flatpak 安装的 OBS,可用命令直接启动。

    flatpak run com.obsproject.Studio
  6. 6添加本地滤镜

    在 OBS 中选中需要转写的音频源,添加 LocalVocal 滤镜即可开始使用语音识别与字幕功能。

如何确认成功

启动 OBS 后,在滤镜列表中能看到 LocalVocal 插件条目,即表示插件加载成功。

常见问题

Q:Windows 该下载哪个版本的安装包?

A:按显卡选择:没有独显或不确定选 generic 通用版,N 卡选 NVidia 版,A 卡选 AMD 版,以获得对应的 GPU 加速。

Q:需要联网或上传音频吗?

A:不需要。插件在本地用 Whisper 等模型完成转写,音频不上传,适合关注隐私和延迟的直播场景。

Q:支持多少种语言?

A:实时转写支持 100 种语言,并可选用 HuggingFace 上数百个针对不同语言微调过的 Whisper 模型。

Q:字幕只能显示在屏幕上吗?

A:不止。可以把字幕写入 .txt 或 .srt 文件,也可以推送到 YouTube、Twitch 等 RTMP 流,还能实时翻译成其他语言。

注意事项

  • README 提供的是预编译安装包,普通用户直接下载对应版本安装即可,无需自行编译。
  • Linux 的下载表格在 README 节选中不完整,请到项目 Releases 页面确认可用版本。
  • 插件支持 CUDA、hipBLAS(AMD ROCm)、Apple Arm64、AVX 与 SSE 加速,硬件不同效果会有差异。
  • 下载链接指向 locaal-ai/obs-localvocal 仓库的 Releases,与项目主页 royshil/obs-localvocal 同源,注意确认来源。

核心亮点

  • 完全本地推理,音频不出设备,隐私安全且无网络依赖
  • 基于 Whisper 模型,支持多语言识别,准确度高
  • 深度集成 OBS,可灵活定制字幕样式和位置,操作流畅

不足之处

  • 对硬件要求较高,需较强 CPU/GPU 才能流畅实时转写
  • 文档和社区支持相对有限,新手配置可能遇到门槛

适用场景

  • 游戏直播或在线教学时,为观众实时生成字幕
  • 录制视频时快速添加高质量字幕,免去后期手动编辑
  • 视频会议或网络研讨会中,提供本地实时文字辅助

替代项目

OBS-Studio-Whisper、obs-whisper-caption、Vibe (OpenAI Whisper 桌面应用)

项目介绍

obs-localvocal 是一个语音识别领域的开源项目,官方简介:OBS plugin for local speech recognition and captioning using AI。项目使用 C++ 开发,在 GitHub 上获得 1605 星标。

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1613 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3713 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11823 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5649 2026-08-13