CVPR23_LFDM 是视频领域的开源项目,由 nihaomiao 开发,2023 年首次发布。
它收录于视频分类,该分类目前共有 472 个项目,GitHub 星标数为 470。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-23。基于BSD-2-Clause许可证,可自由使用和修改,无付费版本。
它主要面向的使用场景是:图像动画生成。同类可对比的替代方案包括 Video Diffusion Models、MCVD、FDM。

输入一张图,用光流扩散模型生成动态视频
CVPR23_LFDM 是 CVPR 2023 论文《Conditional Image-to-Video Generation with Latent Flow Diffusion Models》的官方 PyTorch 实现。该项目旨在解决条件图像到视频生成问题,即给定一张静态图像和运动条件(如文本或动作),生成连续、自然的视频序列。其核心创新在于将光流信息引入潜在扩散模型,通过预测潜在空间中的光流场来引导视频帧的生成,从而在保持图像内容一致性的同时,实现可控且高质量的运动效果。项目支持多种条件输入,能够生成分辨率较高、时序连贯的视频,适用于图像动画、视频预测等任务。代码基于 PyTorch 和潜在扩散模型框架,提供了训练和推理脚本,方便研究者复现和扩展。
Video Diffusion Models、MCVD、FDM
CVPR23_LFDM 是视频领域的开源项目,由 nihaomiao 开发,2023 年首次发布。
它收录于视频分类,该分类目前共有 472 个项目,GitHub 星标数为 470。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-23。基于BSD-2-Clause许可证,可自由使用和修改,无付费版本。
它主要面向的使用场景是:图像动画生成。同类可对比的替代方案包括 Video Diffusion Models、MCVD、FDM。
上一篇:MuseV
下一篇:MM-Diffusion
MoneyPrinterTurbo
开源
输入一句话,高清短视频自动出炉,文案配音全包了
利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short ···
seedance-2.0-api
开源
快速上手字节Seedance 2.0,文本/图片一键生成视频
Seedance 2.0 API — text-to-video and image-to-video examples
openscreen
开源
免费无水印录屏做演示,替代 Screen Studio
Record your screen, ship a demo. Free and open-source, GPU-accelerated, no watermark···
auto-subs
开源
在剪辑软件里直接生成字幕,省去导出导入的麻烦
On-device subtitle generation that connects directly to DaVinci Resolve, Premiere, a···