video-diffusion
本站收录 14 个带「video-diffusion」标签的 AI 开源项目
Awesome-Video-Diffusion-Models这是一个关于视频扩散模型的精选资源列表,源自一篇发表在《计算机科学与技术评论》(CSUR)上的综述论文。项目系统梳理了视频扩散模型领域的核心研究,包括模型架构、★ 2,318
Text-To-Video-AIText-To-Video-AI 是一个基于 AI 的文本转视频生成工具,旨在帮助用户通过简单的文字描述快速生成视频内容。它解决了传统视频制作门槛高、耗时长的痛★ 834
AlayaRendererAlayaRenderer 是一个面向游戏和虚拟世界的生成式世界渲染器,定位为 AI 原生渲染管线。它利用扩散模型和 G-buffer 技术,将传统渲染流程与视★ 689
Magic-MeMagic-Me 是一个基于扩散模型的个性化视频生成项目,旨在实现身份特定的视频定制化生成。它解决了现有文本到视频模型难以保持特定人物身份一致性的问题,允许用户★ 459
VADERVADER 是一个用于视频扩散模型对齐的开源项目,通过奖励梯度(Reward Gradients)对预训练的视频生成模型进行微调,以提升生成视频的质量和与人类偏★ 318
video_to_worldvideo_to_world 是一个从视频扩散模型生成的三维世界中重建 3D 场景的开源项目。它解决的核心问题是:视频扩散模型生成的视频序列存在固有的三维不一致★ 316
SCoPESCoPE 是一个面向三维感知视频生成的开源研究项目,核心是提出「视线坐标位置编码」(Sightline-Coordinate Positional Encod★ 208
worldexplorerWorldExplorer 是一个面向 3D 场景生成的研究项目,源自 SIGGRAPH Asia 2025 论文。它解决的核心问题是:如何从单张图片或视频输入★ 196
vivid123ViVid-1-to-3 是一个基于视频扩散模型的单图生成多视角新视图的开源项目,由 CVPR 2024 Highlight 论文提出。它解决的是从单张图像生成★ 180
svorSVOR(Stable Video Object Removal)是一个基于视频扩散模型的视频物体移除工具,旨在从视频中无缝删除指定物体并填充背景。它解决的是传★ 128
diffusion-vasdiffusion-vas 是 CVPR 2025 的官方代码实现,专注于视频无模态分割(Video Amodal Segmentation)任务。该任务旨在从★ 127
LongLive-RAGLongLive-RAG 是一个面向长视频生成的通用检索增强框架,其官方实现基于 PyTorch。它解决的是现有视频生成模型难以生成长时间、多场景连贯视频的问题★ 114
UniVidX_ComfyUIUniVidX_ComfyUI 是一个为 ComfyUI 开发的视频分解自定义节点,基于 SIGGRAPH 2026 论文 UniVidX 实现。它能够将输入视★ 78
mcmmcm(Motion Consistency Model)是一个面向视频生成的加速采样模型,来自NeurIPS 2024论文。它针对视频扩散模型推理速度慢的问题★ 71