gcd

单目视频一键生成动态新视角,让相机自由飞

GCD(Generative Camera Dolly)是ECCV 2024 Oral的官方实现,专注于极端单目动态新视角合成。它解决的是从单个移动摄像头拍摄的视频中,生成任意新视角的动态场景问题,尤其在相机运动幅度大、场景动态变化的情况下,传统方法难以生成连贯且高质量的新视图。该项目的核心能力是利用生成式扩散模型,结合深度估计和相机位姿信息,对动态场景进行4D重建和渲染,从而合成出具有真实感的新视角视频。其技术栈涵盖深度学习、扩散模型、计算机视觉和图形学。项目提供官方代码和模型,支持用户输入单目视频,输出可交互的动态新视角结果。

开源 free 视频生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 292
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类视频生成
开发团队basilevh
所属国家
定价模式free
价格说明开源项目,代码免费,官网提供演示页面,无付费版本。
访问状态
是否开源是
开源协议GPL-3.0
主要语言Python
技术栈/模型3d,4d,computer-graphics,computer-vision,deep-learn,deep-learning,diffusion-models,dynamic-view-synthesis,eccv2024,generative-ai,machine-learning,novel-view-synthesis,object-permanence,research,scene-reconstruction,scene-understanding,stable-video-diffusion,video-generation,video-to-video
GitHub 星标★ 292
30天Star增速
HF 下载量
上线时间2024-05-07 00:00:00
最近更新2026-08-28 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

核心亮点

  • 基于ECCV 2024 Oral,方法前沿,学术认可度高
  • 支持极端相机运动下的动态场景合成,效果显著
  • 提供官方实现,代码和模型开源,便于复现

不足之处

  • 项目处于早期阶段,文档和社区支持待观察
  • 依赖扩散模型,推理可能较慢,资源消耗大

适用场景

  • 电影/视频制作中的自由视角回放
  • VR/AR场景中的动态内容生成
  • 自动驾驶或机器人仿真中的视角扩展

替代项目

DynaNeRF、K-Planes、HyperNeRF

项目介绍

gcd 是计算机视觉领域的开源项目,由 basilevh 开发,2024 年首次发布。

它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 292。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-28。代码免费,官网提供演示页面,无付费版本。从国内网络环境看,可直接访问。

它主要面向的使用场景是:电影/视频制作中的自由视角回放。同类可对比的替代方案包括 DynaNeRF、K-Planes、HyperNeRF。

上一篇:FluidNexus

下一篇:TesserAct

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4019 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90930 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2046 2026-08-14