Deepstory

输入故事文本,自动生成角色说话视频

Deepstory 是一个将文本或生成文本转化为视频的开源工具,核心功能是让角色以指定声音朗读故事并配合动画口型。它结合了 GPT-2 文本生成、DC-TTS 语音合成和 First Order Motion Model 人脸动画技术,通过 Flask 提供 Web 界面,用户输入故事文本后,系统自动生成配音和角色说话视频。项目主要面向有声书、同人创作和深度伪造实验场景,解决了从纯文本到带人物动画视频的端到端生成问题。目前处于早期阶段,星标数不高,但技术栈完整,适合对多模态生成感兴趣的开发者二次开发。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 103
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队thetobysiu
所属国家
定价模式free
价格说明开源项目,本地部署,完全免费。
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型audiobook,dc-tts,dctts,deep-fake,deep-learning,fan-fiction,first-order-motion-model,flask,generative-ai,gpt,gpt-2,gpt2,jquery,llm,pytorch,storytelling,tts,witcher,witcher-3,witcher3
GitHub 星标★ 103
30天Star增速
HF 下载量
上线时间2020-05-09 00:00:00
最近更新2026-03-01 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

核心亮点

  • 端到端流水线:文本→语音→人脸动画,一条命令生成视频
  • 集成 GPT-2 文本续写,可自动扩展故事内容
  • 基于 Flask 提供 Web 界面,降低使用门槛

不足之处

  • 文档和示例较少,上手需要自行摸索
  • 依赖多个重型模型,部署资源要求高

适用场景

  • 有声书自动生成带口型动画的视频
  • 同人故事角色可视化创作
  • 教学或营销视频快速原型制作

替代项目

SadTalker、Wav2Lip、MakeItTalk

项目介绍

Deepstory 是视频领域的开源项目,由 thetobysiu 开发,2020 年首次发布。

它收录于视频分类,该分类目前共有 473 个项目,GitHub 星标数为 103。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-03-01。本地部署,完全免费。

它主要面向的使用场景是:有声书自动生成带口型动画的视频。同类可对比的替代方案包括 SadTalker、Wav2Lip、MakeItTalk。

上一篇:redditube

下一篇:baize-toolbox

同类项目推荐

MoneyPrinterTurbo 开源

输入一句话,高清短视频自动出炉,文案配音全包了

利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short ···

★ 125106 2026-08-09
seedance-2.0-api 开源

快速上手字节Seedance 2.0,文本/图片一键生成视频

Seedance 2.0 API — text-to-video and image-to-video examples

★ 332 2026-08-26
openscreen 开源

免费无水印录屏做演示,替代 Screen Studio

Record your screen, ship a demo. Free and open-source, GPU-accelerated, no watermark···

★ 3185 2026-08-10
MagicDance 开源

一张图+任意动作,生成身份不变的逼真人物视频

[ICML 2024] MagicPose(also known as MagicDance): Realistic Human Poses and Facial Ex···

★ 777 2026-08-09