LightX2V
开源
把静态图变动态视频,轻量推理快人一步
LightX2V 是一个轻量级的图像到视频(I2V)动作生成推理框架,专注于降低视频生成模型的使用门槛。···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
LightX2V
开源
把静态图变动态视频,轻量推理快人一步
LightX2V 是一个轻量级的图像到视频(I2V)动作生成推理框架,专注于降低视频生成模型的使用门槛。···
Video-T1
开源
给视频生成加推理链,不重训练也能提升动态质量
Video-T1 是首个面向视频生成的测试时扩展(Test-Time Scaling)方法,由南洋理工大学等机构在 ICC···
Aether
开源
让视频生成自带几何,赋能具身智能空间理解
Aether 是一个面向具身智能与空间智能的统一世界模型,核心解决视频生成中几何一致性缺失的问题。它···
LeanVAE
开源
让视频扩散模型更轻更快,重建不拖后腿
LeanVAE 是一个面向视频扩散模型的高效重建 VAE,旨在解决视频生成中 VAE 计算开销大、内存占用高的···
ReCamMaster
开源
上传一段视频,自由控制相机视角,生成全新运镜视频
ReCamMaster 是一个基于单段视频的相机控制生成式渲染工具,核心解决视频重渲染中相机视角无法自由···
liquid-shape-distortions
开源
在浏览器中实时生成流动迷幻的液体扭曲动画。
这是一个基于WebGL着色器的实时液体形状扭曲动画库,专为在浏览器中创造迷幻视觉效果而设计。它利用···
VACE
开源
一个模型搞定视频生成与编辑,多条件随心控
VACE 是一个基于扩散模型的全能视频生成与编辑框架,由腾讯等机构在 ICCV 2025 论文中提出。它解决···
JavisDiT
开源
一键生成音画同步的短视频,告别无声视频。
JavisDiT 是一个面向音频-视频联合生成的扩散 Transformer 模型系列,由 ICLR 2026 论文官方实现。···
unified_video_action
开源
一个模型同时生成视频和动作,让机器人看得懂未来、动得准。
unified_video_action 是 RSS 2025 论文的官方 PyTorch 实现,旨在统一视频生成与机器人动作预测。···
vynaro
开源
7步全自动生成影视解说视频,从素材到成片一键搞定
Vynaro(叙影 AI)是一款基于 Tauri 2、Rust 和 React 19 构建的桌面端 AI 视频创作工具,专注于影···
splicr
开源
导入素材,7步自动出解说成片
splicr(Vynaro 叙影 AI)是一款基于 Tauri 2 + Rust + React 19 构建的桌面端 AI 影视解说与第一人···
DiT-Extrapolation
开源
不重训、不微调,让视频扩散模型直接生成超长视频
DiT-Extrapolation 是 ICML 2025 论文《RIFLEx: A Free Lunch for Length Extrapolation in Video ···
VideoLingo-OneClick
开源
一键启动,批量完成视频翻译、配音和字幕生成
VideoLingo-OneClick 是一个面向视频创作者和本地化团队的自动化工具,整合了 VideoLingo 的翻译能···
TheoremExplainAgent
开源
让LLM定理推理变成看得懂的动画视频,自动生成教学讲解。
TheoremExplainAgent是一个面向定理理解的多模态视频解释智能体,由ACL 2025 oral论文官方开源。它···
diffusion-forcing-transformer
开源
用历史帧引导扩散模型,生成更连贯的视频
diffusion-forcing-transformer 是 ICML 2025 论文《History-Guided Video Diffusion》的官方 PyTo···
Phantom
开源
让AI生成的视频里,主角永远不跑偏
Phantom 是一个基于扩散模型的文生视频(Text-to-Video)开源项目,专注于解决视频生成中主体一致性···
Mojito
开源
让视频生成听你指挥,精确控制物体运动轨迹和强度
Mojito 是一个面向视频生成的可控运动轨迹与强度控制的开源项目,源自同名论文。它解决的是现有文本···
FlashVideo
开源
高效生成高分辨率视频,先整体后细节,省算力不省画质
FlashVideo 是一个面向高效高分辨率视频生成的开源项目,源自 AAAI-2026 论文。它针对现有视频扩散···
text2video-from-scratch
开源
手把手从零实现视频扩散模型,看懂每一步
这是一个从零开始实现视频扩散模型的教学型开源项目,旨在用清晰、逐步的方式帮助开发者理解文本到···
manim-generator
开源
输入文字描述,自动生成数学动画视频,无需手动编程。
manim-generator 是一个基于大语言模型(LLM)的自动视频生成工具,它利用 manim 库将文本描述转化···
DiffuEraser
开源
上传视频和掩码,一键移除物体,修复结果自然连贯。
DiffuEraser 是一个基于扩散模型的视频修复(video inpainting)工具,旨在解决视频中移除不需要对···
Light-A-Video
开源
上传视频,一句话或一张图,轻松重打光,无需训练
Light-A-Video 是一个无需训练的视频重打光工具,由南洋理工大学等机构提出,论文发表于 ICCV 2025···
X-Dyna
开源
让静态照片动起来,表情动作一起驱动生成自然视频
X-Dyna 是一个基于扩散模型的动态人体图像动画生成工具,核心解决的是让静态人物照片“活起来”并跟···
story-flicks
开源
输入一句话,AI 自动生成高清故事短视频,零剪辑经验也能上手
story-flicks 是一个基于 AI 大模型的一键式故事短视频生成工具。它解决了普通用户制作高质量短视频···