video-diffusion-model
本站收录 12 个带「video-diffusion-model」标签的 AI 开源项目
Awesome-Video-Diffusion-Models这是一个关于视频扩散模型的精选资源列表,源自一篇发表在《计算机科学与技术评论》(CSUR)上的综述论文。项目系统梳理了视频扩散模型领域的核心研究,包括模型架构、★ 2,318
Causal-ForcingCausal-Forcing 是 ICML 2026 论文的官方代码库,提出了一种自回归扩散模型的蒸馏方法,旨在实现高质量、实时的交互式视频生成。它解决了传统扩★ 983
animate-anythinganimate-anything 是一个基于扩散模型的图像动画化开源项目,旨在将静态图片按照用户指定的运动引导(如轨迹、姿态或文本描述)生成细腻的动态视频。它解★ 972
FreeInitFreeInit 是一个针对视频扩散模型的训练后优化方法,由南洋理工大学等机构在 ECCV 2024 提出。它解决视频扩散模型在生成时因初始噪声与视频低频结构不★ 543
AI-Faceless-Video-GeneratorAI-Faceless-Video-Generator 是一个基于 Jupyter Notebook 的开源工具,旨在通过 AI 全自动生成无脸视频(如短视频、★ 508
SCoPESCoPE 是一个面向三维感知视频生成的开源研究项目,核心是提出「视线坐标位置编码」(Sightline-Coordinate Positional Encod★ 208
Video-Motion-CustomizationVideo-Motion-Customization(VMC)是一个基于扩散模型的视频运动定制工具,核心解决文本到视频生成中运动模式难以精确控制的问题。它通过引★ 200
LeanVAELeanVAE 是一个面向视频扩散模型的高效重建 VAE,旨在解决视频生成中 VAE 计算开销大、内存占用高的问题。它通过轻量级架构设计,在保证视频重建质量的同★ 117
LongLive-RAGLongLive-RAG 是一个面向长视频生成的通用检索增强框架,其官方实现基于 PyTorch。它解决的是现有视频生成模型难以生成长时间、多场景连贯视频的问题★ 114
text2video-from-scratch这是一个从零开始实现视频扩散模型的教学型开源项目,旨在用清晰、逐步的方式帮助开发者理解文本到视频生成的核心原理。项目基于PyTorch构建,将复杂的视频扩散模型★ 87
AwesomeMultiModel这是一个AIGC实战入门笔记项目,旨在帮助开发者系统学习和上手各类AIGC技术。项目内容覆盖大语言模型(LLMs)、高效微调(SFT)、检索增强生成(RAG)、★ 79
mcmmcm(Motion Consistency Model)是一个面向视频生成的加速采样模型,来自NeurIPS 2024论文。它针对视频扩散模型推理速度慢的问题★ 71