
obs-localvocal
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
obs-localvocal 是一个专为 OBS Studio 设计的本地语音识别与字幕插件,利用 OpenAI Whisper 等 AI 模型在本地实时将音频转为文字,并生成可自定义风格的字幕。它解决了直播或录制时依赖在线语音服务带来的延迟、隐私和成本问题,让主播、会议录制者等用户无需上传音频即可获得高精度字幕。核心能力包括实时转写、自动断句、字幕样式定制(字体、颜色、位置等)、多语言支持,以及通过 OBS 的源/过滤器系统无缝集成。插件基于 C++ 开发,性能优化良好,支持 GPU 加速,适合在直播、视频会议、无障碍内容制作等场景中提供即时的视觉辅助。
项目数据
使用教程
环境要求
- Windows 10/11(官方提供安装包)或 macOS/Linux(需按 README 构建或使用 flatpak 版 OBS)
- 已安装 OBS Studio
- 按显卡类型选择对应安装包:通用版、NVidia 版或 AMD 版
- macOS 从源码构建时需要 Xcode/CMake 等构建环境(README 未列出完整依赖)
安装与启动步骤
-
1下载安装包
打开项目 Releases 页面,Windows 用户按显卡选择 generic、nvidia 或 amd 版安装程序;Linux 表格在 README 中未完整显示,需自行到 Releases 查找。
-
2运行安装程序
双击下载好的 obs-localvocal-0.6.2-windows-x64-*-Installer.exe,按向导完成安装,插件会被放入 OBS 插件目录。
-
3手动复制插件(macOS)
构建完成后插件文件位于 ./release/Release,把生成的 .plugin 文件复制到 OBS 插件目录,例如 macOS 下的 Application Support/obs-studio/plugins。
cp -r ./release/Release/obs-localvocal.plugin ~/Library/Application Support/obs-studio/plugins/ -
4打包 macOS 安装包
README 给出的打包脚本示例;注意输出可能在 Release 文件夹而非 install 文件夹,需要时把 build_x86_64/Release 重命名为 build_x86_64/install。
./.github/scripts/package-macos -c Release -
5启动 OBS Studio
安装后从系统应用菜单启动 OBS;Linux 上如果是 flatpak 安装的 OBS,可用命令直接启动。
flatpak run com.obsproject.Studio -
6添加本地滤镜
在 OBS 中选中需要转写的音频源,添加 LocalVocal 滤镜即可开始使用语音识别与字幕功能。
如何确认成功
启动 OBS 后,在滤镜列表中能看到 LocalVocal 插件条目,即表示插件加载成功。
常见问题
Q:Windows 该下载哪个版本的安装包?
A:按显卡选择:没有独显或不确定选 generic 通用版,N 卡选 NVidia 版,A 卡选 AMD 版,以获得对应的 GPU 加速。
Q:需要联网或上传音频吗?
A:不需要。插件在本地用 Whisper 等模型完成转写,音频不上传,适合关注隐私和延迟的直播场景。
Q:支持多少种语言?
A:实时转写支持 100 种语言,并可选用 HuggingFace 上数百个针对不同语言微调过的 Whisper 模型。
Q:字幕只能显示在屏幕上吗?
A:不止。可以把字幕写入 .txt 或 .srt 文件,也可以推送到 YouTube、Twitch 等 RTMP 流,还能实时翻译成其他语言。
注意事项
- README 提供的是预编译安装包,普通用户直接下载对应版本安装即可,无需自行编译。
- Linux 的下载表格在 README 节选中不完整,请到项目 Releases 页面确认可用版本。
- 插件支持 CUDA、hipBLAS(AMD ROCm)、Apple Arm64、AVX 与 SSE 加速,硬件不同效果会有差异。
- 下载链接指向 locaal-ai/obs-localvocal 仓库的 Releases,与项目主页 royshil/obs-localvocal 同源,注意确认来源。
核心亮点
- 完全本地推理,音频不出设备,隐私安全且无网络依赖
- 基于 Whisper 模型,支持多语言识别,准确度高
- 深度集成 OBS,可灵活定制字幕样式和位置,操作流畅
不足之处
- 对硬件要求较高,需较强 CPU/GPU 才能流畅实时转写
- 文档和社区支持相对有限,新手配置可能遇到门槛
适用场景
- 游戏直播或在线教学时,为观众实时生成字幕
- 录制视频时快速添加高质量字幕,免去后期手动编辑
- 视频会议或网络研讨会中,提供本地实时文字辅助
替代项目
OBS-Studio-Whisper、obs-whisper-caption、Vibe (OpenAI Whisper 桌面应用)
项目介绍
同类项目推荐
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper