PIA
开源
输入文本,让静态照片动起来,生成个性化动画视频
PIA 是一个基于扩散模型的个性化图像动画生成工具,来自 CVPR 2024。它解决的核心问题是:如何将一···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
PIA
开源
输入文本,让静态照片动起来,生成个性化动画视频
PIA 是一个基于扩散模型的个性化图像动画生成工具,来自 CVPR 2024。它解决的核心问题是:如何将一···
VidToMe
开源
上传视频,输入文字,零训练直接改视频内容
VidToMe 是 CVPR 2024 的官方 PyTorch 实现,提出一种零样本视频编辑方法,通过视频令牌合并(Vide···
FreeInit
开源
不重训模型,让视频生成更连贯更稳定
FreeInit 是一个针对视频扩散模型的训练后优化方法,由南洋理工大学等机构在 ECCV 2024 提出。它解···
animate-anything
开源
上传一张图,指定运动轨迹,即可生成动态视频。
animate-anything 是一个基于扩散模型的图像动画化开源项目,旨在将静态图片按照用户指定的运动引导···
panacea
开源
一键生成自动驾驶全景视频,可控又逼真
Panacea 是 CVPR 2024 的官方实现,专注于自动驾驶场景的全景可控视频生成。它解决自动驾驶仿真中数···
RAVE
开源
快速稳定地编辑视频,用文本指令让扩散模型动起来。
RAVE 是一个基于扩散模型的视频编辑工具,核心思路是通过随机噪声重排(Randomized Noise Shufflin···
LivePhoto
开源
输入一张照片和一句动作描述,即可生成动态视频
LivePhoto 是论文《LivePhoto: Real Image Animation with Text-guided Motion Control》的官方实现···
Video-Motion-Customization
开源
给视频生成装上运动控制器,让动作随你定制
Video-Motion-Customization(VMC)是一个基于扩散模型的视频运动定制工具,核心解决文本到视频生成···
DynamiCrafter
开源
上传一张静态图,AI 让它动起来,生成自然流畅的视频。
DynamiCrafter 是一个基于视频扩散先验的开源图像动画工具,能将静态图片转换为动态视频。它解决了···
KandinskyVideo
开源
输入一句话,AI 自动生成短视频片段
KandinskyVideo 是一个基于潜在扩散模型的多语言文本生成视频的开源项目,由 Kandinsky 团队开发。···
MagicDance
开源
一张图+任意动作,生成身份不变的逼真人物视频
MagicDance(又称MagicPose)是一个基于扩散模型的人体姿态与面部表情重定向工具,由ICML 2024论文···
vox-ai-motion-graphics-generator
开源
输入主题,自动生成 Vox 风格拼贴解说视频
这是一个为编程代理(如 Claude Code、Codex)设计的智能体技能,能将任意主题自动转化为 Vox 风格···
InterpAny-Clearer
开源
让视频慢动作更清晰,任意时刻补帧还能随心操控。
InterpAny-Clearer 是一个基于深度学习的视频帧插值(Video Frame Interpolation)与图像操作工具,···
MotionDirector
开源
上传参考视频,用文本定制生成专属动作视频
MotionDirector 是 ECCV 2024 Oral 论文的开源实现,专注于文本到视频扩散模型的运动定制。它解决的···
LAMP
开源
用少量视频样本,学运动模式,生成和编辑视频
LAMP 是一个基于扩散模型的少样本视频生成框架,发表于 CVPR 2024。它旨在解决视频生成中数据稀缺和···
flatten
开源
用光流引导注意力,让视频编辑不闪不抖,保持时序一致
FLATTEN 是一个基于 PyTorch 实现的视频编辑工具,核心是光流引导的注意力机制,用于在文本到视频编···
pyvideotrans
开源
上传视频,一键生成多语言配音和字幕,轻松出海。
pyvideotrans 是一个开源的视频翻译与配音工具,能够将视频中的语音识别为文字,翻译成目标语言,并···
LLM-groundedVideoDiffusion
开源
用LLM规划场景,让文本生成视频更听话
LLM-grounded Video Diffusion (LVD) 是 ICLR 2024 的官方实现,旨在解决文本到视频生成中语义对齐···
deforum-kandinsky
开源
用 Kandinsky 模型快速生成 Deforum 风格短视频动画
deforum-kandinsky 是一个将 Kandinsky 2.x 模型与 Deforum 动画技术结合的开源工具,用于生成短视···
AI-Video-Translation
开源
一键在Colab里给视频换语言,还带口型同步
这是一个基于Google Colab的简易视频翻译工具,主要功能是将原始视频翻译成多种语言,并同步调整口···
R-ESRGAN-AnimeVideo-UI
开源
一键将动漫视频高清放大,画质飞跃
reav-ui 是一个基于 R-ESRGAN 的视频放大工具,专注于动漫和卡通内容的画质提升。它解决了动漫视频···
TempoTokens
开源
让音频直接驱动视频生成,对齐又多样
TempoTokens 是 AAAI 2024 论文的官方 PyTorch 实现,旨在解决音频到视频生成中多样性与对齐性的难···
SEINE
开源
用文本或图像生成连贯长视频,还能让视频间无缝过渡
SEINE 是一个基于扩散模型的视频生成工具,专注于短片段到长视频的生成,以及视频之间的平滑过渡。···
Free-Bloom
开源
输入一句话,LLM 当导演,LDM 自动生成视频
Free-Bloom 是一个零样本(Zero-Shot)文本生成视频的开源项目,发表于 NeurIPS 2023。它解决的是无···