
PyAutoSRT
拖入视频,自动生成原文+翻译字幕
PyAutoSRT 是一个基于 PySimpleGUI 的桌面工具,用于为任意视频或音频文件自动生成字幕并翻译。它通过调用免费的 Google 语音识别 API 将语音转写为文本,再借助非官方的在线 Google 翻译 API 生成翻译字幕,最终输出 SRT 字幕文件。项目解决了手动打轴和翻译字幕耗时费力的问题,适合个人快速处理外语视频、课程录音或会议记录。核心能力包括:支持常见音视频格式(依赖 ffmpeg 提取音频)、一键生成原文与译文字幕、图形界面操作降低使用门槛。整体流程简单,无需编程即可完成从媒体文件到双语字幕的转换,适合轻量级字幕需求。
开源
free
语音识别
GitHub 星标
★ 190
维护状态
较活跃
是否开源
是
定价模式
free
项目数据
分类语音识别
开发团队botbahlul
所属国家
定价模式free
价格说明开源免费,使用免费Google语音识别API
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型auto-caption,auto-subtitle,captions,ffmpeg,google-translate,google-translate-api,pysimplegui,python,speech-recognition,srt-subtitle,subriptext,subtitle,voice-recognition
GitHub 星标★ 190
30天Star增速
HF 下载量
上线时间2023-02-10 00:00:00
最近更新2026-08-31 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-15
浏览次数0
使用教程
核心亮点
- 图形界面操作,无需命令行,适合非技术用户
- 同时输出原文和翻译字幕,节省双语字幕制作时间
- 依赖免费 Google 语音识别与翻译接口,零成本使用
不足之处
- 依赖非官方 Google 翻译 API,接口变动可能导致翻译失效
- 语音识别准确率受音频质量影响,无自定义模型或离线方案
适用场景
- 为外语视频快速生成中文字幕
- 整理会议录音并翻译成文本字幕
- 个人学习时给课程视频添加双语字幕
替代项目
whisper、subtitle-edit、autosub
项目介绍
同类项目推荐
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper