whisper-website

上传音频,浏览器里直接出字幕文件

whisper-website 是一个可自托管的轻量 Web 应用,把 OpenAI 的 Whisper 语音识别模型封装成浏览器可用的界面,用户上传音频后即可自动生成字幕文件。它解决的是本地跑 Whisper 需要写脚本、调参数、处理格式的麻烦,让非技术用户也能一键完成音频转字幕。核心能力包括:通过 FastAPI + Uvicorn 提供后端接口,前端网页直接上传音频并触发识别,调用 Whisper 模型完成语音转文字,并输出可下载的字幕文件(如 SRT/VTT)。项目用 Python 编写,依赖清晰,适合部署在个人服务器或内网环境,数据不出本地,兼顾隐私与便利。它面向字幕组、播客创作者、会议记录整理者等需要批量或快速生成字幕的人群,也常被当作 Whisper 的入门级 Web 封装参考。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 325
维护状态 活跃
是否开源
定价模式 free

项目数据

分类语音识别
开发团队Kabanosk
所属国家
官网地址
定价模式free
价格说明开源免费,需自行部署
访问状态
是否开源
开源协议MIT
主要语言Python
技术栈/模型audio-to-text,fastapi,hacktoberfest,open-source,openai,python3,speech-to-text,subtitles,subtitles-generator,uvicorn,website,whisper
GitHub 星标★ 325
30天Star增速
HF 下载量
上线时间2022-09-26 00:00:00
最近更新2026-09-21 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-23
浏览次数0

使用教程

核心亮点

  • 自托管部署,音频数据留在本地,隐私可控
  • 用 FastAPI 封装 Whisper,接口简单,前端上传即转写
  • 输出标准字幕格式,可直接用于视频剪辑或播放器

不足之处

  • 项目体量小,缺少批量任务队列与进度反馈
  • 模型与依赖需自行配置,首次部署有门槛

适用场景

  • 播客或视频创作者快速为素材生成字幕初稿
  • 企业内部会议录音转文字并导出字幕归档
  • 个人在本地服务器搭建私有语音转写服务

替代项目

whisper.cpp、faster-whisper、Buzz

项目介绍

whisper-website 是语音识别领域的开源项目,由 Kabanosk 开发,2022 年首次发布。

它收录于语音识别分类,该分类目前共有 192 个项目,GitHub 星标数为 325。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-21。开源免费,需自行部署。

它主要面向的使用场景是:播客或视频创作者快速为素材生成字幕初稿。同类可对比的替代方案包括 whisper.cpp、faster-whisper、Buzz。

上一篇:wyoming-faster-whisper

下一篇:jt-live-whisper

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1614 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3733 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13