视频

汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。

共收录 478 个开源项目

LightX2V 开源

把静态图变动态视频,轻量推理快人一步

LightX2V 是一个轻量级的图像到视频(I2V)动作生成推理框架,专注于降低视频生成模型的使用门槛。···

★ 2860 评分 2025-03-24
Video-T1 开源

给视频生成加推理链,不重训练也能提升动态质量

Video-T1 是首个面向视频生成的测试时扩展(Test-Time Scaling)方法,由南洋理工大学等机构在 ICC···

★ 319 评分 2025-03-24
Aether 开源

让视频生成自带几何,赋能具身智能空间理解

Aether 是一个面向具身智能与空间智能的统一世界模型,核心解决视频生成中几何一致性缺失的问题。它···

★ 611 评分 2025-03-24
LeanVAE 开源

让视频扩散模型更轻更快,重建不拖后腿

LeanVAE 是一个面向视频扩散模型的高效重建 VAE,旨在解决视频生成中 VAE 计算开销大、内存占用高的···

★ 117 评分 2025-03-18
ReCamMaster 开源

上传一段视频,自由控制相机视角,生成全新运镜视频

ReCamMaster 是一个基于单段视频的相机控制生成式渲染工具,核心解决视频重渲染中相机视角无法自由···

★ 1878 评分 2025-03-14
liquid-shape-distortions 开源

在浏览器中实时生成流动迷幻的液体扭曲动画。

这是一个基于WebGL着色器的实时液体形状扭曲动画库,专为在浏览器中创造迷幻视觉效果而设计。它利用···

★ 110 评分 2025-03-12
VACE 开源

一个模型搞定视频生成与编辑,多条件随心控

VACE 是一个基于扩散模型的全能视频生成与编辑框架,由腾讯等机构在 ICCV 2025 论文中提出。它解决···

★ 3954 评分 2025-03-08
JavisDiT 开源

一键生成音画同步的短视频,告别无声视频。

JavisDiT 是一个面向音频-视频联合生成的扩散 Transformer 模型系列,由 ICLR 2026 论文官方实现。···

★ 383 评分 2025-03-07
unified_video_action 开源

一个模型同时生成视频和动作,让机器人看得懂未来、动得准。

unified_video_action 是 RSS 2025 论文的官方 PyTorch 实现,旨在统一视频生成与机器人动作预测。···

★ 413 评分 2025-03-04
vynaro 开源

7步全自动生成影视解说视频,从素材到成片一键搞定

Vynaro(叙影 AI)是一款基于 Tauri 2、Rust 和 React 19 构建的桌面端 AI 视频创作工具,专注于影···

★ 428 评分 2025-02-28
splicr 开源

导入素材,7步自动出解说成片

splicr(Vynaro 叙影 AI)是一款基于 Tauri 2 + Rust + React 19 构建的桌面端 AI 影视解说与第一人···

★ 428 评分 2025-02-28
DiT-Extrapolation 开源

不重训、不微调,让视频扩散模型直接生成超长视频

DiT-Extrapolation 是 ICML 2025 论文《RIFLEx: A Free Lunch for Length Extrapolation in Video ···

★ 829 评分 2025-02-21
VideoLingo-OneClick 开源

一键启动,批量完成视频翻译、配音和字幕生成

VideoLingo-OneClick 是一个面向视频创作者和本地化团队的自动化工具,整合了 VideoLingo 的翻译能···

★ 92 评分 2025-02-20
TheoremExplainAgent 开源

让LLM定理推理变成看得懂的动画视频,自动生成教学讲解。

TheoremExplainAgent是一个面向定理理解的多模态视频解释智能体,由ACL 2025 oral论文官方开源。它···

★ 1505 评分 2025-02-16
diffusion-forcing-transformer 开源

用历史帧引导扩散模型,生成更连贯的视频

diffusion-forcing-transformer 是 ICML 2025 论文《History-Guided Video Diffusion》的官方 PyTo···

★ 709 评分 2025-02-11
Phantom 开源

让AI生成的视频里,主角永远不跑偏

Phantom 是一个基于扩散模型的文生视频(Text-to-Video)开源项目,专注于解决视频生成中主体一致性···

★ 1517 评分 2025-02-10
Mojito 开源

让视频生成听你指挥,精确控制物体运动轨迹和强度

Mojito 是一个面向视频生成的可控运动轨迹与强度控制的开源项目,源自同名论文。它解决的是现有文本···

★ 62 评分 2025-02-10
FlashVideo 开源

高效生成高分辨率视频,先整体后细节,省算力不省画质

FlashVideo 是一个面向高效高分辨率视频生成的开源项目,源自 AAAI-2026 论文。它针对现有视频扩散···

★ 484 评分 2025-02-07
text2video-from-scratch 开源

手把手从零实现视频扩散模型,看懂每一步

这是一个从零开始实现视频扩散模型的教学型开源项目,旨在用清晰、逐步的方式帮助开发者理解文本到···

★ 87 评分 2025-01-30
manim-generator 开源

输入文字描述,自动生成数学动画视频,无需手动编程。

manim-generator 是一个基于大语言模型(LLM)的自动视频生成工具,它利用 manim 库将文本描述转化···

★ 118 评分 2025-01-28
DiffuEraser 开源

上传视频和掩码,一键移除物体,修复结果自然连贯。

DiffuEraser 是一个基于扩散模型的视频修复(video inpainting)工具,旨在解决视频中移除不需要对···

★ 694 评分 2025-01-17
Light-A-Video 开源

上传视频,一句话或一张图,轻松重打光,无需训练

Light-A-Video 是一个无需训练的视频重打光工具,由南洋理工大学等机构提出,论文发表于 ICCV 2025···

★ 524 评分 2025-01-16
X-Dyna 开源

让静态照片动起来,表情动作一起驱动生成自然视频

X-Dyna 是一个基于扩散模型的动态人体图像动画生成工具,核心解决的是让静态人物照片“活起来”并跟···

★ 268 评分 2025-01-16
story-flicks 开源

输入一句话,AI 自动生成高清故事短视频,零剪辑经验也能上手

story-flicks 是一个基于 AI 大模型的一键式故事短视频生成工具。它解决了普通用户制作高质量短视频···

★ 2533 评分 2025-01-16