
auto-caption
开麦即出字幕,会议直播网课实时上屏
auto-caption 是一款基于 Electron 与 Python 构建的跨平台实时字幕显示软件,核心目标是把麦克风或系统音频中的语音实时转写为文字并叠加显示在屏幕上。它解决的是会议、直播、网课、线下演讲等场景中缺少即时字幕的问题,让听障用户、非母语听众或嘈杂环境下的观众也能跟上内容。项目通过 ASR(自动语音识别)把音频流转为文本,借助 Electron 实现桌面端窗口悬浮与跨平台运行,Python 侧负责识别引擎调用。用户可将其作为独立字幕条使用,也可配合 OBS 等工具推流,实现实时字幕上屏。整体定位轻量、开箱即用,适合个人和小团队快速搭建实时字幕方案,无需从零对接识别 API。
开源
free
语音识别
GitHub 星标
★ 580
维护状态
较活跃
是否开源
是
定价模式
free
项目数据
分类语音识别
开发团队HiMeditator
所属国家
定价模式free
价格说明开源免费软件,需自行部署使用
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型asr,audio2text,captions,electron,python,real-time,subtitles
GitHub 星标★ 580
30天Star增速
HF 下载量
上线时间2025-05-11 00:00:00
最近更新2026-09-15 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-16
浏览次数0
使用教程
核心亮点
- Electron+Python 架构,Windows/macOS/Linux 均可运行
- 支持实时音频转写并悬浮显示,可直接用于直播推流字幕
- 技术栈清晰(TypeScript+ASR),便于二次开发和替换识别引擎
不足之处
- 早期项目,579 星规模,功能与稳定性仍在迭代
- 依赖本地 Python 与识别模型,环境配置对新手有一定门槛
适用场景
- 线上会议/网课实时字幕辅助听障或非母语听众
- 直播推流时叠加实时字幕提升可访问性
- 线下演讲或视频播放时外挂字幕条显示
替代项目
Buzz、whisper.cpp、subtitles
项目介绍
上一篇:vocotype-cli
下一篇:leopard
同类项目推荐
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper