TATS
开源
用文本或音频生成分钟级连贯长视频,突破短视频限制。
TATS 是一个基于 PyTorch 的长视频生成框架,来自 ECCV 2022 论文。它旨在解决现有视频生成模型只能···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
TATS
开源
用文本或音频生成分钟级连贯长视频,突破短视频限制。
TATS 是一个基于 PyTorch 的长视频生成框架,来自 ECCV 2022 论文。它旨在解决现有视频生成模型只能···
MMVID
开源
输入文字和图片,自动生成匹配的动态视频
MMVID是一个基于多模态条件约束的视频生成开源项目,来自CVPR 2022论文。它解决的核心问题是:如何···
digan
开源
用隐式表示生成任意长度视频,动态更真实
DIGAN 是一个基于隐式生成对抗网络的视频生成模型,由新加坡国立大学等机构提出,发表于 ICLR 2022···
stylegan-v
开源
用StyleGAN2的代价生成连续高清视频,支持任意时长和帧率
StyleGAN-V 是一个基于 StyleGAN2 架构的连续视频生成模型,由 Snap 研究院在 CVPR 2022 提出。它解···
NWT-pytorch
开源
用音频驱动生成同步视频,快速上手跨模态生成
NWT-pytorch 是 NWT(Neural Waveform Transform)模型的非官方 PyTorch 实现,专注于音频到视频的···
clip-gan
开源
用AI把音乐自动变成视觉大片,零剪辑经验也能玩
clip-gan 是一个利用 CLIP 模型引导生成式对抗网络(GAN)自动创作音乐视频的开源实验项目。它解决···
articulated-animation
开源
用一张图和一段视频,生成逼真的关节动画
articulated-animation 是论文《Motion Representations for Articulated Animation》的官方代码实···
MoCoGAN-HD
开源
用图像生成器直接合成高清视频,分辨率高且训练稳定
MoCoGAN-HD 是一个基于 GAN 的高分辨率视频生成框架,核心思想是利用预训练的高质量图像生成器(如···
podcast-maker
开源
把新闻简报一键变成 YouTube 视频,全自动发布
podcast-maker 是一个将新闻简报自动转化为 YouTube 视频的全自动工具。它利用动态图形(motion gr···
text2video
开源
输入文本,自动生成带语音和画面的教学视频
text2video 是一个将文本自动转换为视频的开源工具,旨在提升学习内容的吸引力。它通过自然语言处理···
lipsync
开源
上传视频和音频,一键生成唇形同步视频,支持CPU运行
lipsync 是一个基于 Wav2Lip 的 Python 唇形同步库,旨在简化视频和图片中人物嘴唇与音频的同步过程···
deep-landscape
开源
一张风景照,生成自然动态视频
DeepLandscape 是 ECCV2020 论文的官方实现,专注于风景视频的对抗性建模。它解决的核心问题是:如···
redditube
开源
把 Reddit 热帖一键变成视频,自动配音加字幕
redditube 是一个从 Reddit 帖子和评论生成视频的工具。它自动抓取 Reddit 上的热门帖子及评论,将···
Deepstory
开源
输入故事文本,自动生成角色说话视频
Deepstory 是一个将文本或生成文本转化为视频的开源工具,核心功能是让角色以指定声音朗读故事并配···
tgan2
开源
低显存训练高分辨率视频生成模型,稀疏训练密集生成
tgan2 是论文《Train Sparsely, Generate Densely: Memory-efficient Unsupervised Training of Hi···
Music-Dance-Video-Synthesis
开源
输入音乐,自动生成同步舞蹈视频
Music-Dance-Video-Synthesis 是一个基于 PyTorch 的自监督舞蹈视频合成项目,发表于 ACM MM 2020 ···
conditional-motion-propagation
开源
用少量标注,自动预测并传播视频中的运动信息
这是一个CVPR 2019的官方代码项目,专注于视频中的条件运动传播问题。其核心目标是解决视频中物体运···
swd
开源
无需标注,用GAN同时生成图像和视频
swd 是一个基于 TensorFlow 的无监督视频与图像生成开源项目,旨在通过生成对抗网络(GAN)实现高质···
videogan
开源
用GAN生成动态场景视频,复现经典论文
VideoGAN 是论文《Generating Videos with Scene Dynamics》的 TensorFlow 实现,属于早期视频生成···
voxel-flow
开源
用体素流场合成视频帧,搞定插帧和预测
voxel-flow 是 ICCV 2017 Oral 论文的开源实现,提出用深度体素流(Deep Voxel Flow)进行视频帧合···
video_prediction
开源
用GAN+VAE预测视频未来帧,生成多种可能结果
这是一个基于生成对抗网络(GAN)和变分自编码器(VAE)的视频预测开源项目,核心是解决视频帧序列···
improved-video-gan
开源
用GAN生成更连贯真实的视频,支持多任务扩展
Improved-Video-GAN 是一个基于生成对抗网络(GAN)的视频生成开源项目,源自论文《Improving Vide···