视频

汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。

共收录 478 个开源项目

PIA 开源

输入文本,让静态照片动起来,生成个性化动画视频

PIA 是一个基于扩散模型的个性化图像动画生成工具,来自 CVPR 2024。它解决的核心问题是:如何将一···

★ 974 评分 2023-12-21
VidToMe 开源

上传视频,输入文字,零训练直接改视频内容

VidToMe 是 CVPR 2024 的官方 PyTorch 实现,提出一种零样本视频编辑方法,通过视频令牌合并(Vide···

★ 228 评分 2023-12-18
FreeInit 开源

不重训模型,让视频生成更连贯更稳定

FreeInit 是一个针对视频扩散模型的训练后优化方法,由南洋理工大学等机构在 ECCV 2024 提出。它解···

★ 543 评分 2023-12-12
animate-anything 开源

上传一张图,指定运动轨迹,即可生成动态视频。

animate-anything 是一个基于扩散模型的图像动画化开源项目,旨在将静态图片按照用户指定的运动引导···

★ 972 评分 2023-12-07
panacea 开源

一键生成自动驾驶全景视频,可控又逼真

Panacea 是 CVPR 2024 的官方实现,专注于自动驾驶场景的全景可控视频生成。它解决自动驾驶仿真中数···

★ 263 评分 2023-12-06
RAVE 开源

快速稳定地编辑视频,用文本指令让扩散模型动起来。

RAVE 是一个基于扩散模型的视频编辑工具,核心思路是通过随机噪声重排(Randomized Noise Shufflin···

★ 312 评分 2023-12-05
LivePhoto 开源

输入一张照片和一句动作描述,即可生成动态视频

LivePhoto 是论文《LivePhoto: Real Image Animation with Text-guided Motion Control》的官方实现···

★ 206 评分 2023-11-30
Video-Motion-Customization 开源

给视频生成装上运动控制器,让动作随你定制

Video-Motion-Customization(VMC)是一个基于扩散模型的视频运动定制工具,核心解决文本到视频生成···

★ 200 评分 2023-11-29
DynamiCrafter 开源

上传一张静态图,AI 让它动起来,生成自然流畅的视频。

DynamiCrafter 是一个基于视频扩散先验的开源图像动画工具,能将静态图片转换为动态视频。它解决了···

★ 3008 评分 2023-11-27
KandinskyVideo 开源

输入一句话,AI 自动生成短视频片段

KandinskyVideo 是一个基于潜在扩散模型的多语言文本生成视频的开源项目,由 Kandinsky 团队开发。···

★ 185 评分 2023-11-19
MagicDance 开源

一张图+任意动作,生成身份不变的逼真人物视频

MagicDance(又称MagicPose)是一个基于扩散模型的人体姿态与面部表情重定向工具,由ICML 2024论文···

★ 777 评分 2023-11-08
vox-ai-motion-graphics-generator 开源

输入主题,自动生成 Vox 风格拼贴解说视频

这是一个为编程代理(如 Claude Code、Codex)设计的智能体技能,能将任意主题自动转化为 Vox 风格···

★ 219 评分 2023-11-07
InterpAny-Clearer 开源

让视频慢动作更清晰,任意时刻补帧还能随心操控。

InterpAny-Clearer 是一个基于深度学习的视频帧插值(Video Frame Interpolation)与图像操作工具,···

★ 296 评分 2023-10-27
MotionDirector 开源

上传参考视频,用文本定制生成专属动作视频

MotionDirector 是 ECCV 2024 Oral 论文的开源实现,专注于文本到视频扩散模型的运动定制。它解决的···

★ 1054 评分 2023-10-12
LAMP 开源

用少量视频样本,学运动模式,生成和编辑视频

LAMP 是一个基于扩散模型的少样本视频生成框架,发表于 CVPR 2024。它旨在解决视频生成中数据稀缺和···

★ 284 评分 2023-10-06
flatten 开源

用光流引导注意力,让视频编辑不闪不抖,保持时序一致

FLATTEN 是一个基于 PyTorch 实现的视频编辑工具,核心是光流引导的注意力机制,用于在文本到视频编···

★ 212 评分 2023-10-05
pyvideotrans 开源

上传视频,一键生成多语言配音和字幕,轻松出海。

pyvideotrans 是一个开源的视频翻译与配音工具,能够将视频中的语音识别为文字,翻译成目标语言,并···

★ 19148 评分 2023-10-02
LLM-groundedVideoDiffusion 开源

用LLM规划场景,让文本生成视频更听话

LLM-grounded Video Diffusion (LVD) 是 ICLR 2024 的官方实现,旨在解决文本到视频生成中语义对齐···

★ 172 评分 2023-10-02
deforum-kandinsky 开源

用 Kandinsky 模型快速生成 Deforum 风格短视频动画

deforum-kandinsky 是一个将 Kandinsky 2.x 模型与 Deforum 动画技术结合的开源工具,用于生成短视···

★ 103 评分 2023-10-02
AI-Video-Translation 开源

一键在Colab里给视频换语言,还带口型同步

这是一个基于Google Colab的简易视频翻译工具,主要功能是将原始视频翻译成多种语言,并同步调整口···

★ 255 评分 2023-10-01
R-ESRGAN-AnimeVideo-UI 开源

一键将动漫视频高清放大,画质飞跃

reav-ui 是一个基于 R-ESRGAN 的视频放大工具,专注于动漫和卡通内容的画质提升。它解决了动漫视频···

★ 84 评分 2023-09-29
TempoTokens 开源

让音频直接驱动视频生成,对齐又多样

TempoTokens 是 AAAI 2024 论文的官方 PyTorch 实现,旨在解决音频到视频生成中多样性与对齐性的难···

★ 130 评分 2023-09-28
SEINE 开源

用文本或图像生成连贯长视频,还能让视频间无缝过渡

SEINE 是一个基于扩散模型的视频生成工具,专注于短片段到长视频的生成,以及视频之间的平滑过渡。···

★ 967 评分 2023-09-22
Free-Bloom 开源

输入一句话,LLM 当导演,LDM 自动生成视频

Free-Bloom 是一个零样本(Zero-Shot)文本生成视频的开源项目,发表于 NeurIPS 2023。它解决的是无···

★ 98 评分 2023-09-22