Whisper-TikTok

输入文本或音频,一键生成带字幕配音的TikTok短视频

Whisper-TikTok 是一个将 AI 工具链整合到 TikTok 视频创作流程中的开源项目。它主要解决从文本或音频内容快速生成带配音的短视频的问题,核心能力包括:利用 OpenAI Whisper 模型进行语音识别与字幕生成,通过 Microsoft Edge 的 TTS(文本转语音)服务生成自然语音,并借助 FFmpeg 完成视频的合成与剪辑。项目提供命令行接口,用户输入文本或音频后,可自动生成包含背景音乐、配音和字幕的 TikTok 风格视频,大幅降低视频制作门槛。其技术栈轻量,依赖 Python 生态,适合个人创作者或小型团队快速批量产出短视频内容。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 340
维护状态 维护中
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队MatteoFasulo
所属国家
定价模式free
价格说明开源项目,完全免费,需自行部署使用。
访问状态
是否开源是
开源协议Apache-2.0
主要语言Python
技术栈/模型edge-tts,ffmpeg,python,text-to-speech,tiktok,whisper
GitHub 星标★ 340
30天Star增速
HF 下载量
上线时间2023-04-26 00:00:00
最近更新2026-09-22 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数0

使用教程

核心亮点

  • 整合 Whisper 语音识别与 edge-tts 语音合成,自动化生成高质量配音和字幕
  • 基于 FFmpeg 实现视频合成,无需专业剪辑软件即可产出成品视频
  • 命令行操作简单,适合批量处理,提升内容生产效率

不足之处

  • 依赖外部服务(Microsoft Edge TTS),网络与接口稳定性可能影响使用
  • 功能相对单一,缺乏视频模板或特效定制能力
  • 文档/社区待观察

适用场景

  • 自媒体创作者快速生成短视频内容
  • 将长音频或播客转为带字幕的短视频片段
  • 批量制作多语言配音的营销视频

替代项目

Whisper、FFmpeg、TikTok API 相关项目

项目介绍

Whisper-TikTok 是自动化工作流领域的开源项目,由 MatteoFasulo 开发,2023 年首次发布。

它收录于自动化工作流分类,该分类目前共有 509 个项目,GitHub 星标数为 340。

项目仍在小幅维护中,最近一次代码更新于 2026-09-22。完全免费,需自行部署使用。

它主要面向的使用场景是:自媒体创作者快速生成短视频内容。同类可对比的替代方案包括 Whisper、FFmpeg、TikTok API 相关项目。

上一篇:codex-storyboard

下一篇:tg2obsidian

同类项目推荐

n8n 开源

拖拽搭建自动化流程,轻松接入 AI 与 400+ 应用,搞定重复工作。

Fair-code workflow automation platform with native AI capabilities. Combine visual b···

★ 205700 2026-08-10
feishu-docx 开源

让 AI 代理轻松读写飞书文档,双向转换 Markdown

Feishu/Lark Docs、Sheet、Bitable <-> Markdown | AI Agent-friendly knowledge base exp···

★ 262 2026-08-09
robotcode 开源

让 Robot Framework 拥有现代 IDE 体验,调试、补全、运行一气呵成。

Open Source Toolkit for Robot Framework, providing Language Server Protocol support,···

★ 301 2026-08-10
puppeteer 开源

用 JavaScript 轻松操控无头浏览器,搞定自动化测试与网页抓取。

JavaScript API for Chrome and Firefox

★ 95609 2026-08-10