youtube-auto-dub 是音频音乐领域的开源项目,由 mazzasaverio 开发,2024 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 73。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。完全免费,本地部署,无在线服务,无付费版本。
它主要面向的使用场景是:视频创作者将内容翻译成多语言,扩大受众。同类可对比的替代方案包括 OpenAI Whisper、Coqui TTS、Argos Translate。

本地免费给YouTube视频配音,克隆原声换语言,自动同步字幕
youtube-auto-dub 是一个本地优先的开源 YouTube 视频配音工具,旨在将视频中的原始语音克隆并翻译成另一种语言,同时保持时间同步。它解决了视频创作者和翻译者需要手动配音、字幕不同步或依赖付费云服务的问题。核心能力包括:使用 Chatterbox 进行声音克隆,确保翻译后的语音保留原说话人的音色;集成 faster-whisper 实现高精度语音识别;通过 NLLB 模型进行多语言翻译;支持多角色声音区分、烧录字幕,并可选集成 Wav2Lip 实现唇形同步。所有处理均在用户自己的机器上运行,通过简单 CLI 操作,无需上传数据,保护隐私且零成本。项目处于早期阶段,但功能完整,适合技术用户快速上手。
OpenAI Whisper、Coqui TTS、Argos Translate
youtube-auto-dub 是音频音乐领域的开源项目,由 mazzasaverio 开发,2024 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 73。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。完全免费,本地部署,无在线服务,无付费版本。
它主要面向的使用场景是:视频创作者将内容翻译成多语言,扩大受众。同类可对比的替代方案包括 OpenAI Whisper、Coqui TTS、Argos Translate。
上一篇:vibevoice-studio
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···