Awesome-Interactive-World-Model
开源
一张图看懂交互式视频世界模型研究脉络
这是一个关于交互式视频世界模型的综合性资源列表,旨在系统梳理该领域的研究进展。它解决了研究人···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
Awesome-Interactive-World-Model
开源
一张图看懂交互式视频世界模型研究脉络
这是一个关于交互式视频世界模型的综合性资源列表,旨在系统梳理该领域的研究进展。它解决了研究人···
Causal-Forcing
开源
让扩散视频生成快如实时,交互体验不掉帧
Causal-Forcing 是 ICML 2026 论文的官方代码库,提出了一种自回归扩散模型的蒸馏方法,旨在实现高···
给 AI 代理一键接入顶级视频生成,成本封顶不失控
vibeframe 是一个面向编码代理(coding agents)的前沿 AI 视频生成工具,它通过统一的 CLI 和 MCP···
bottube
开源
用物理验证让 AI 视频更可信,智能体一起创作
bottube 是一个基于“物理人工智能证明”的 AI 原生视频平台,属于 RustChain DePIN 生态。它通过硬···
BigBanana-AI-Director
开源
一句话生成完整短剧,从剧本到成片全自动,告别抽卡式生成。
BigBanana AI Director 是一个面向 AI 短剧和漫剧创作的工业级一站式平台,旨在解决传统 AI 视频生···
remotion-skills
开源
让 AI 用 React 轻松生成专业视频
remotion-skills 是一个面向 AI 智能体的 Remotion 最佳实践技能库,旨在帮助开发者通过 React 快速···
Toonflow-app
开源
一本小说几分钟变动画短剧,省掉编剧分镜的苦力活。
开源的一站式 AI 短剧创作工具,可将小说、剧本快速转化为动画短剧,集成 AI 编剧、智能分镜、角色···
lingbot-world
开源
给个开头画面,AI 自动接续成片
致力于推进开源世界模型的前沿项目,通过大规模数据与先进架构构建可泛化的世界模型,助力视频生成···
MOVA
开源
一句话生成音画同步视频,告别后期配音对齐
MOVA 是一个统一的多模态基础模型,能够在一个模型中同时生成同步的视频和音频,解决了传统视频生成···
Awesome-Video-World-Models
开源
把视频生成当世界模拟器,一页看懂关键研究
这是一个关于视频生成作为世界模型的精选资源列表,从机制视角梳理了视频生成与物理世界模拟的关联···
openclip
开源
长视频自动剪出高光片段,省去逐帧筛选
OpenClip 是一个用 Python 编写的开源工具,专门解决长视频中精彩片段难以快速定位的问题。它借助大···
ManimCat
开源
说句话,AI 帮你生成数学动画视频
ManimCat 是一个基于 AI 的数学动画生成工具,用户只需用自然语言描述想要的数学场景,即可自动生成···
autoshorts
开源
游戏录像一键变竖屏爆款短视频,自动剪高光加配音
autoshorts 是一个自动化短视频生成工具,专注于从长格式游戏录像中提取高光片段并制作成适合 TikT···
waoowaoo
开源
从剧本到成片,一条龙全流程包办
行业首个工业级全流程 AI 影视生产平台,以专业 AI Agent 驱动可控的电影与视频制作,覆盖从短视频···
ReVidgen
开源
给具身智能世界造一面视频生成能力的照妖镜
ReVidgen 是一个面向具身智能世界的视频生成模型基准与评估工具包,由 ICML 2026 论文提出。它重新···
yt-short-clipper
开源
长视频一键变竖屏高光短片,自动追踪人脸加字幕
yt-short-clipper 是一款面向 Windows 的桌面应用,专门把 YouTube 长视频自动剪成适合 TikTok、Re···
ltx-video-mac
开源
在 Mac 上本地生成 AI 视频,无需云端,开箱即用。
ltx-video-mac 是一个专为 Apple Silicon Mac 设计的原生 AI 视频生成应用,基于 LTX-Video 模型,···
OmniTransfer
开源
一个框架搞定视频风格、姿态、身份迁移,省时省力。
OmniTransfer 是一个面向时空视频迁移的全能框架,旨在解决视频生成中多种迁移任务分散、流程复杂的···
ComfyUI-Wan-VACE-Prep
开源
拖拽节点搞定视频转场、扩展和修复,专为 Wan VACE 优化
ComfyUI-Wan-VACE-Prep 是一个专为 ComfyUI 设计的自定义节点包,旨在简化视频生成模型在常见编辑任···
Open-PhyGDPO
开源
让AI生成的视频更符合物理规律,动作更真实自然
Open-PhyGDPO 是一个面向文本生成视频(T2V)任务的物理一致性优化框架,核心方法是物理感知的分组···
deepdream-video-pytorch
开源
用DeepDream给视频加特效,不闪不抖,流畅梦幻
这是一个基于PyTorch的DeepDream视频处理工具,旨在为视频添加梦幻般的艺术效果,同时保持时间一致···
flowm
开源
用流等变世界模型,让动态视频生成更连贯
flowm 是 Flow Equivariant World Models(ICML 2026)的完整模型实现,旨在构建具备记忆能力的动态···
comfyUI-LongLook
开源
给 ComfyUI 装上 FreeLong 长视频生成增强引擎,让 Wan 视频更连贯
LongLook 是一个 ComfyUI 节点包,将 NeurIPS 2024 论文 FreeLong 的频谱混合技术引入 Wan 2.2 视频···
Vid2World
开源
把视频变成能交互的虚拟世界,驱动机器人或游戏。
Vid2World 是一个将视频扩散模型转化为交互式世界模型的开源项目,源自 ICLR 2026 论文。它解决的核···