auto-caption

开麦即出字幕,会议直播网课实时上屏

auto-caption 是一款基于 Electron 与 Python 构建的跨平台实时字幕显示软件,核心目标是把麦克风或系统音频中的语音实时转写为文字并叠加显示在屏幕上。它解决的是会议、直播、网课、线下演讲等场景中缺少即时字幕的问题,让听障用户、非母语听众或嘈杂环境下的观众也能跟上内容。项目通过 ASR(自动语音识别)把音频流转为文本,借助 Electron 实现桌面端窗口悬浮与跨平台运行,Python 侧负责识别引擎调用。用户可将其作为独立字幕条使用,也可配合 OBS 等工具推流,实现实时字幕上屏。整体定位轻量、开箱即用,适合个人和小团队快速搭建实时字幕方案,无需从零对接识别 API。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 580
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类语音识别
开发团队HiMeditator
所属国家
官网地址
定价模式free
价格说明开源免费软件,需自行部署使用
访问状态
是否开源
开源协议MIT
主要语言TypeScript
技术栈/模型asr,audio2text,captions,electron,python,real-time,subtitles
GitHub 星标★ 580
30天Star增速
HF 下载量
上线时间2025-05-11 00:00:00
最近更新2026-09-15 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-16
浏览次数0

使用教程

核心亮点

  • Electron+Python 架构,Windows/macOS/Linux 均可运行
  • 支持实时音频转写并悬浮显示,可直接用于直播推流字幕
  • 技术栈清晰(TypeScript+ASR),便于二次开发和替换识别引擎

不足之处

  • 早期项目,579 星规模,功能与稳定性仍在迭代
  • 依赖本地 Python 与识别模型,环境配置对新手有一定门槛

适用场景

  • 线上会议/网课实时字幕辅助听障或非母语听众
  • 直播推流时叠加实时字幕提升可访问性
  • 线下演讲或视频播放时外挂字幕条显示

替代项目

Buzz、whisper.cpp、subtitles

项目介绍

auto-caption 是一个语音识别领域的开源项目,官方简介:A cross-platform real-time subtitle display software. 一个跨平台的实时字幕显示软件。。项目使用 TypeScript 开发,在 GitHub 上获得 579 星标。

上一篇:vocotype-cli

下一篇:leopard

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1613 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3713 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11823 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5649 2026-08-13