PVDM
开源
在潜空间玩转扩散模型,高效生成高质量视频
PVDM(Video Probabilistic Diffusion Models in Projected Latent Space)是CVPR 2023收录的视频生···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
PVDM
开源
在潜空间玩转扩散模型,高效生成高质量视频
PVDM(Video Probabilistic Diffusion Models in Projected Latent Space)是CVPR 2023收录的视频生···
storyteller
开源
输入故事文本,自动生成配图、旁白和语音,一键产出多媒体故事。
storyteller 是一个多模态 AI 故事生成器,结合 Stable Diffusion、GPT 和神经文本转语音技术,将文···
ebsynth_utility
开源
一键把 Stable Diffusion 风格化图像变成流畅视频
ebsynth_utility 是一个针对 AUTOMATIC1111 Stable Diffusion WebUI 的扩展插件,主要解决利用 img···
StyleSV
开源
用 StyleGAN 让视频合成平滑不闪烁,帧帧自然衔接
StyleSV 是一个基于 StyleGAN 的视频合成研究项目,发表于 ICLR 2023,核心目标是实现平滑的视频合···
MM-Diffusion
开源
一个模型同时生成匹配的音频和视频,告别音画不同步。
MM-Diffusion是CVPR 2023提出的多模态扩散模型,用于联合生成音频和视频。它解决的是传统生成模型只···
motion-latent-diffusion
开源
输入文字,秒级生成高质量3D人体动作
motion-latent-diffusion 是一个基于潜在空间运动扩散模型的开源项目,发表于 CVPR 2023。它旨在解···
magvit
开源
用掩码 Transformer 高效生成高质量视频,支持预测、补全和插值。
MAGVIT 是 Google 发布的视频生成模型,基于掩码生成式视频 Transformer 架构,官方提供 JAX 实现。···
InternVideo
开源
用海量视频数据预训练,一个模型搞定分类、问答和字幕生成。
InternVideo 是一个面向多模态理解的开源视频基础模型项目,由上海人工智能实验室发布,相关论文发···
latentblending
开源
让 AI 图像在提示词间丝滑变身,轻松生成过渡动画。
latentblending 是一个基于 Stable Diffusion 的开源工具,用于在多个文本提示词之间生成丝滑流畅的···
sd-parseq
开源
让 Stable Diffusion 参数动起来,一键生成平滑动画视频
sd-parseq 是一个用于 Stable Diffusion 的参数序列器,旨在解决 AI 视频生成和动画制作中参数难以···
StoryToolkitAI
开源
用 AI 自动转录素材,一句话搜出你要的镜头。
StoryToolkitAI 是一款面向视频剪辑师和电影制作人的 AI 辅助编辑工具,它通过自动转录视频/音频内···
make-a-video-pytorch
开源
用文本描述直接生成短视频,复现Meta最新AI模型
Make-A-Video 的 PyTorch 非官方实现,复现 Meta AI 提出的文本生成视频模型。该模型基于扩散模型架···
phenaki-pytorch
开源
用文本生成最长2分钟视频,基于Mask GIT的PyTorch实现
Phenaki-PyTorch 是 Phenaki 视频生成模型的非官方 PyTorch 实现。Phenaki 由 Google 提出,核心创···
Stable-Diffusion-Video2Video
开源
上传视频,一键风格化,自动逐帧转换输出新视频
这是一个为AUTOMATIC1111/stable-diffusion-webui编写的小型脚本,用于将视频逐帧通过img2img模式处···
WACV23_TSNet
开源
一键把视频动作迁移到任何人身上,生成逼真换脸视频
TSNet 是 WACV 2023 论文《Cross-identity Video Motion Retargeting with Joint Transformation a···
giffusion
开源
用 Stable Diffusion 一键生成 GIF 动画和视频
giffusion 是一个基于 Stable Diffusion 的创意工具,用于生成 GIF 和视频动画。它解决了静态图像生···
stable-diffusion-videos
开源
两张图之间自动过渡,静态画面秒变动画
通过探索 Stable Diffusion 的潜在空间并在文本提示词之间平滑变形,让 AI 生成酷炫的动态视频。无···
momentumjs
开源
用 p5.js 风格代码在 AE 里写动画,告别手动关键帧
momentumjs 是一个将 After Effects 动画创作与 p5.js 风格代码结合的开源工具,主要面向设计师和创···
deforum-stable-diffusion
开源
用 Stable Diffusion 把图片和视频变成动态艺术动画
Deforum Stable Diffusion 是一个基于 Stable Diffusion 的图像生成工具,源自 Google Colab 笔记本···
transframer-pytorch
开源
用 U-Net+Transformer 生成 30 秒连贯视频
Transframer-pytorch 是 DeepMind 提出的 Transframer 架构的非官方 PyTorch 实现,用于生成最长 3···
CogVideo_demo
开源
输入文字,一键生成视频,快速体验 CogVideo 模型。
CogVideo_demo 是一个非官方的 CogVideo 演示应用,旨在为 CogVideo 文本生成视频模型提供一个简单···
CogVideo
开源
打句话或传张图,AI 立刻生成视频
智谱开源的文字与图像生成视频系列模型,包含 2024 年发布的 CogVideoX 与 ICLR 2023 收录的 CogVi···
flexible-diffusion-modeling-videos-p···
开源
用扩散模型生成连贯长视频,复现论文方案
这是一个基于PyTorch实现的开源视频生成项目,对应论文《Flexible Diffusion Modeling of Long Vid···
video-diffusion-pytorch
开源
用 PyTorch 实现扩散模型,从文本生成连贯视频
video-diffusion-pytorch 是 Jonathan Ho 论文《Video Diffusion Models》的 PyTorch 实现,将 DDP···