simple-obs-stt

直播时自动生成实时字幕,直接叠加到 OBS 画面

simple-obs-stt 是一个为 OBS 直播和录播场景设计的实时字幕工具,它通过语音识别(STT)将麦克风或系统音频中的语音转换为文字,并直接以字幕或键盘输入的形式叠加到 OBS 画面中。该项目解决了主播、会议录制或内容创作者在直播时手动添加字幕的痛点,无需额外视频编辑软件,即可自动生成实时字幕。核心能力包括:支持多种语音识别后端(如本地 Whisper 或云端 API),低延迟的音频流处理,以及灵活的字幕样式和位置配置。它基于 TypeScript 开发,易于扩展和集成,适合需要无障碍传播或提升观看体验的直播场景。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 106
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队mmpneo
所属国家
定价模式free
价格说明开源项目,GPL-3.0许可,可自行部署使用,完全免费。
访问状态
是否开源是
开源协议GPL-3.0
主要语言TypeScript
技术栈/模型akita,angular,azure,captions,obs,speech,speech-recognition,speech-to-text,stt,stt-plugins,subtitles,tauri,text-animation,tts,twitch,webrtc
GitHub 星标★ 106
30天Star增速
HF 下载量
上线时间2021-04-25 00:00:00
最近更新2026-06-13 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

核心亮点

  • 实时语音转文字,自动生成字幕,省去手动添加的麻烦
  • 支持本地和云端多种识别引擎,灵活适配不同隐私和性能需求
  • 与 OBS 深度集成,字幕样式和位置可自定义,不影响直播画面布局

不足之处

  • 文档和社区支持尚待完善,初期配置可能需要一定技术门槛
  • 语音识别准确率受环境噪音和口音影响,可能需要调参优化

适用场景

  • 游戏直播时实时显示玩家语音字幕,方便观众理解
  • 在线会议或讲座录制,自动生成字幕用于后期剪辑或无障碍传播
  • 多语言直播场景,通过翻译插件结合实现跨语言字幕

替代项目

OBS 内置字幕功能(需搭配外部 STT 服务)、Live Captions(OBS 插件)、Voice2Json(配合 OBS 使用)

项目介绍

simple-obs-stt 是语音识别领域的开源项目,由 mmpneo 开发,2021 年首次发布。

它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 106。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-06-13。GPL-3.0许可,可自行部署使用,完全免费。

它主要面向的使用场景是:游戏直播时实时显示玩家语音字幕,方便观众理解。同类可对比的替代方案包括 OBS 内置字幕功能(需搭配外部 STT 服务)、Live Captions(OBS 插件)、Voice2Json(配合 OBS 使用)。

上一篇:FastSpeech2

下一篇:athena

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13