
asmr-dubber
音声作品一键识别翻译配音,产出双语字幕和双语音轨
asmr-dubber 是一个用 Python 编写的音视频字幕与配音工具,主要面向 ASMR、音声作品等需要跨语言处理的场景。它把语音识别(ASR)、台本导入、AI 翻译、双语字幕、音色克隆、语音合成(TTS)和混音整合成一条流水线,目标是把原本需要多个工具手动拼接的配音流程自动化。用户可以先让 ASR 识别原音频并生成字幕,也可以直接导入官方台本,再经 AI 翻译得到双语字幕,随后用音色克隆和 TTS 生成目标语言配音,最后混音输出双语音频。项目基于 Gradio 提供界面,底层涉及 parakeet、indextts2 等语音模型,支持 Linux 环境运行,适合想给外语音声作品做本地化字幕和配音的个人用户。
项目数据
使用教程
核心亮点
- 把 ASR、翻译、TTS、混音串成一条流水线,减少手动切换工具的成本
- 支持台本导入,有官方台本时能跳过 ASR 直接翻译,识别质量更可控
- 集成音色克隆与 indextts2,可为目标语言配音保留原声风格
不足之处
- 项目星标较少,属于早期阶段,稳定性和边界情况处理待观察
- 依赖多个语音模型,安装配置和显存/算力要求可能较高
适用场景
- 给日语 ASMR 音声作品生成中文字幕并配上中文音轨
- 把外语播客或访谈自动转成双语字幕和配音版本
- 个人创作者为自制音声内容快速产出多语言版本
替代项目
Buzz、whisperX、GPT-SoVITS
项目介绍
同类项目推荐
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···
WhisperSubTranslate
开源
本地免费生成字幕并翻译,无需上传,隐私无忧
A free, local desktop app to extract subtitles (SRT) from video and translate them i···