whisper-subs 是语音识别领域的开源项目,由 GeiserX 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 192 个项目,GitHub 星标数为 102。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。开源免费插件,本地部署使用。
它主要面向的使用场景是:家庭Jellyfin影音库中大量外语片缺少字幕,需要自动补齐。同类可对比的替代方案包括 Bazarr、SubtitleEdit、whisper.cpp。

Jellyfin 本地自动生成字幕,音频不出服务器
whisper-subs 是一个 Jellyfin 媒体服务器插件,用本地 Whisper 模型为视频自动生成字幕,所有音频处理都在自己的服务器上完成,不依赖云端 API。它解决的是家庭影音库中大量影片缺少字幕、手动下载或使用在线字幕服务存在隐私与网络依赖的问题。核心能力包括:在 Jellyfin 任务中自动扫描媒体库并为缺失字幕的视频生成字幕;调用本地 Whisper 模型进行语音识别,支持多语言;生成字幕后可直接被 Jellyfin 播放器识别加载。项目用 C# 编写,面向 .NET 与 Jellyfin 插件体系,适合 homelab 用户、自建媒体服务器玩家,以及希望字幕生成完全离线、可控、不泄露音频内容的场景。
Bazarr、SubtitleEdit、whisper.cpp
whisper-subs 是语音识别领域的开源项目,由 GeiserX 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 192 个项目,GitHub 星标数为 102。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。开源免费插件,本地部署使用。
它主要面向的使用场景是:家庭Jellyfin影音库中大量外语片缺少字幕,需要自动补齐。同类可对比的替代方案包括 Bazarr、SubtitleEdit、whisper.cpp。
下一篇:mila
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper