项目预览
项目数据
分类语音识别
开发团队Carleslc
所属国家
定价模式free
价格说明开源免费,使用需自备Whisper与DeepL API密钥
访问状态
是否开源是
开源协议
主要语言Jupyter Notebook
技术栈/模型audio,audio-processing,captions,colab-notebook,deepl,ffmpeg,google-colab,jupyter-notebook,language,openai-whisper,python,speech-to-text,subtitles,text,transcribe,transcription,translate,translation,whisper,whisper-api
GitHub 星标★ 396
30天Star增速
HF 下载量
上线时间2023-02-06 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-12
浏览次数0
项目介绍
Star 增长趋势
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
正在加载星标数据…
技术标签
使用教程
—
核心亮点
- 把 Whisper 转写和 DeepL 翻译串成完整流水线,一步得到带时间轴的双语字幕
- 提供 Colab Notebook,无需本地配环境即可跑通,ffmpeg 音频处理已集成
- 支持多语言识别与翻译,适合播客、会议、视频等跨语言内容处理
不足之处
- 依赖 DeepL API,需要自行申请密钥,免费额度有限且大文件会受限
- 以 Notebook 形式组织,缺少模块化封装和命令行工具,工程化集成不便
适用场景
- 把英文播客或访谈录音转写成中文字幕
- 给外语视频课程批量生成翻译字幕
- 会议录音快速整理成可读的多语言文字稿
替代项目
whisper、faster-whisper、whisperX
上一篇:Voconly
下一篇:nomily-app
同类项目推荐
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper
