stable-diffusion-webui-vid2vid
开源
把视频逐帧AI重绘,一键生成风格化新视频
这是一个为AUTOMATIC1111的stable-diffusion-webui设计的视频转视频扩展脚本,能够将输入视频逐帧转···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 528 个开源项目
stable-diffusion-webui-vid2vid
开源
把视频逐帧AI重绘,一键生成风格化新视频
这是一个为AUTOMATIC1111的stable-diffusion-webui设计的视频转视频扩展脚本,能够将输入视频逐帧转···
PVDM
开源
在潜空间玩转扩散模型,高效生成高质量视频
PVDM(Video Probabilistic Diffusion Models in Projected Latent Space)是CVPR 2023收录的视频生···
storyteller
开源
输入故事文本,自动生成配图、旁白和语音,一键产出多媒体故事。
storyteller 是一个多模态 AI 故事生成器,结合 Stable Diffusion、GPT 和神经文本转语音技术,将文···
ebsynth_utility
开源
一键把 Stable Diffusion 风格化图像变成流畅视频
ebsynth_utility 是一个针对 AUTOMATIC1111 Stable Diffusion WebUI 的扩展插件,主要解决利用 img···
StyleSV
开源
用 StyleGAN 让视频合成平滑不闪烁,帧帧自然衔接
StyleSV 是一个基于 StyleGAN 的视频合成研究项目,发表于 ICLR 2023,核心目标是实现平滑的视频合···
MM-Diffusion
开源
一个模型同时生成匹配的音频和视频,告别音画不同步。
MM-Diffusion是CVPR 2023提出的多模态扩散模型,用于联合生成音频和视频。它解决的是传统生成模型只···
motion-latent-diffusion
开源
输入文字,秒级生成高质量3D人体动作
motion-latent-diffusion 是一个基于潜在空间运动扩散模型的开源项目,发表于 CVPR 2023。它旨在解···
magvit
开源
用掩码 Transformer 高效生成高质量视频,支持预测、补全和插值。
MAGVIT 是 Google 发布的视频生成模型,基于掩码生成式视频 Transformer 架构,官方提供 JAX 实现。···
InternVideo
开源
用海量视频数据预训练,一个模型搞定分类、问答和字幕生成。
InternVideo 是一个面向多模态理解的开源视频基础模型项目,由上海人工智能实验室发布,相关论文发···
latentblending
开源
让 AI 图像在提示词间丝滑变身,轻松生成过渡动画。
latentblending 是一个基于 Stable Diffusion 的开源工具,用于在多个文本提示词之间生成丝滑流畅的···
sd-parseq
开源
让 Stable Diffusion 参数动起来,一键生成平滑动画视频
sd-parseq 是一个用于 Stable Diffusion 的参数序列器,旨在解决 AI 视频生成和动画制作中参数难以···
StoryToolkitAI
开源
用 AI 自动转录素材,一句话搜出你要的镜头。
StoryToolkitAI 是一款面向视频剪辑师和电影制作人的 AI 辅助编辑工具,它通过自动转录视频/音频内···
make-a-video-pytorch
开源
用文本描述直接生成短视频,复现Meta最新AI模型
Make-A-Video 的 PyTorch 非官方实现,复现 Meta AI 提出的文本生成视频模型。该模型基于扩散模型架···
phenaki-pytorch
开源
用文本生成最长2分钟视频,基于Mask GIT的PyTorch实现
Phenaki-PyTorch 是 Phenaki 视频生成模型的非官方 PyTorch 实现。Phenaki 由 Google 提出,核心创···
Stable-Diffusion-Video2Video
开源
上传视频,一键风格化,自动逐帧转换输出新视频
这是一个为AUTOMATIC1111/stable-diffusion-webui编写的小型脚本,用于将视频逐帧通过img2img模式处···
WACV23_TSNet
开源
一键把视频动作迁移到任何人身上,生成逼真换脸视频
TSNet 是 WACV 2023 论文《Cross-identity Video Motion Retargeting with Joint Transformation a···
giffusion
开源
用 Stable Diffusion 一键生成 GIF 动画和视频
giffusion 是一个基于 Stable Diffusion 的创意工具,用于生成 GIF 和视频动画。它解决了静态图像生···
stable-diffusion-videos
开源
两张图之间自动过渡,静态画面秒变动画
通过探索 Stable Diffusion 的潜在空间并在文本提示词之间平滑变形,让 AI 生成酷炫的动态视频。无···
momentumjs
开源
用 p5.js 风格代码在 AE 里写动画,告别手动关键帧
momentumjs 是一个将 After Effects 动画创作与 p5.js 风格代码结合的开源工具,主要面向设计师和创···
deforum-stable-diffusion
开源
用 Stable Diffusion 把图片和视频变成动态艺术动画
Deforum Stable Diffusion 是一个基于 Stable Diffusion 的图像生成工具,源自 Google Colab 笔记本···
transframer-pytorch
开源
用 U-Net+Transformer 生成 30 秒连贯视频
Transframer-pytorch 是 DeepMind 提出的 Transframer 架构的非官方 PyTorch 实现,用于生成最长 3···
CogVideo_demo
开源
输入文字,一键生成视频,快速体验 CogVideo 模型。
CogVideo_demo 是一个非官方的 CogVideo 演示应用,旨在为 CogVideo 文本生成视频模型提供一个简单···
CogVideo
开源
打句话或传张图,AI 立刻生成视频
智谱开源的文字与图像生成视频系列模型,包含 2024 年发布的 CogVideoX 与 ICLR 2023 收录的 CogVi···
flexible-diffusion-modeling-videos-p···
开源
用扩散模型生成连贯长视频,复现论文方案
这是一个基于PyTorch实现的开源视频生成项目,对应论文《Flexible Diffusion Modeling of Long Vid···