YUME

用世界模型实时生成可交互视频,从文本或图片秒变动态画面。

YUME 是一个基于世界模型的实时视频生成项目,官方代码库。它支持文本到视频和图像到视频的生成,强调交互式与实时生成能力。项目旨在解决传统视频生成速度慢、缺乏交互性的问题,通过世界模型理解物理规律和场景动态,实现更连贯、可控的视频内容创作。核心能力包括:从文本或静态图像生成动态视频,支持用户交互式调整生成过程,并追求低延迟的实时输出。目前项目处于早期阶段(681星),代码库提供核心模型实现和推理脚本,适合研究人员和开发者探索世界模型在视频生成中的应用。

开源 free 视频生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 684
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类视频生成
开发团队stdstu12
所属国家
官网地址
定价模式free
价格说明开源项目,Apache-2.0 许可证,可免费使用和部署。
访问状态
是否开源是
开源协议Apache-2.0
主要语言Python
技术栈/模型image-to-video,interactive-generation,real-time-generation,text-to-video,world-model
GitHub 星标★ 684
30天Star增速
HF 下载量
上线时间2025-07-14 00:00:00
最近更新2026-09-18 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 实时生成能力突出,主打低延迟视频合成,区别于传统慢速生成模型。
  • 融合世界模型,视频动态更符合物理规律,提升连贯性和真实性。
  • 支持文本和图像双模态输入,交互式生成,创作灵活度高。

不足之处

  • 项目处于早期,文档和社区支持尚待完善。
  • 模型训练和推理资源需求高,普通硬件难以运行。

适用场景

  • 游戏和虚拟现实中的实时场景生成
  • 创意短视频的快速原型制作
  • 交互式艺术和动态内容创作

替代项目

CogVideo、ModelScope Text-to-Video、AnimateDiff

项目介绍

YUME 是视频领域的开源项目,由 stdstu12 开发,2025 年首次发布。

它收录于视频分类,该分类目前共有 473 个项目,GitHub 星标数为 684。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-18。Apache-2.0 许可证,可免费使用和部署。

它主要面向的使用场景是:游戏和虚拟现实中的实时场景生成。同类可对比的替代方案包括 CogVideo、ModelScope Text-to-Video、AnimateDiff。

上一篇:phenaki-pytorch

下一篇:forge-film

同类项目推荐

MoneyPrinterTurbo 开源

输入一句话,高清短视频自动出炉,文案配音全包了

利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short ···

★ 125106 2026-08-09
seedance-2.0-api 开源

快速上手字节Seedance 2.0,文本/图片一键生成视频

Seedance 2.0 API — text-to-video and image-to-video examples

★ 332 2026-08-26
openscreen 开源

免费无水印录屏做演示,替代 Screen Studio

Record your screen, ship a demo. Free and open-source, GPU-accelerated, no watermark···

★ 3185 2026-08-10
MagicDance 开源

一张图+任意动作,生成身份不变的逼真人物视频

[ICML 2024] MagicPose(also known as MagicDance): Realistic Human Poses and Facial Ex···

★ 777 2026-08-09