cvpr2024

本站收录 14 个带「cvpr2024」标签的 AI 开源项目

SyncTalkSyncTalk 是一个基于 CVPR 2024 论文的高保真数字人说话头合成项目,核心解决传统说话头生成中嘴唇、表情、姿态与音频不同步的问题。它通过引入同步模★ 1,628CVPR2024-Papers-with-Code-Demo这是一个CVPR 2024论文与代码的精选合集,旨在解决计算机视觉领域研究者难以快速获取最新成果和复现资源的问题。项目系统性地整理了CVPR 2024上发表的论★ 1,411CityDreamerCityDreamer 是 CVPR 2024 论文的官方实现,专注于生成无边界的三维城市模型。它采用组合式生成模型,将城市分解为建筑、道路、植被等独立模块,分★ 700Awesome-CVPR2026-CVPR2025-ICCV2025-CVPR2024-ECCV2026-ECCV2024-AIGC这是一个汇集CVPR、ICCV、ECCV等顶级计算机视觉会议中AIGC相关论文与代码的精选列表。项目旨在解决研究者难以系统追踪前沿AIGC成果的问题,按会议年份★ 676MIGCMIGC是一个由CVPR 2024 Highlight和TPAMI 2024论文支持的图像生成项目,专注于多实例生成与编辑。它解决了现有文本到图像模型在生成多个★ 613EscherNetEscherNet是一个基于生成模型的视图合成工具,由CVPR 2024作为Oral论文提出。它解决了从少量输入图像生成多视角一致新视图的问题,核心能力在于其可★ 381ViP-LLaVAViP-LLaVA是CVPR 2024收录的多模态大模型,旨在让模型理解任意视觉提示(如点、框、涂鸦等),而不仅限于文本指令。它解决了现有视觉语言模型只能处理全★ 338MaterialPaletteMaterialPalette 是 CVPR 2024 的官方实现,旨在从单张真实世界图像中提取材质属性(包括反照率、法线和粗糙度),并生成可编辑的材质贴图。它★ 283FaceTalkFaceTalk 是一个基于音频驱动的 3D 数字人头像动画生成框架,来自 CVPR 2024。它利用扩散模型将语音音频转化为神经参数化头部模型(如 FLAME★ 240EcoDepthEcoDepth是CVPR 2024收录的单目深度估计项目,旨在解决扩散模型在深度估计中条件利用不足的问题。它通过有效条件化Stable Diffusion,实★ 220pix2gestaltpix2gestalt 是 CVPR 2024 论文的开源代码,专注于模态补全(amodal completion)任务,即从部分可见的物体图像中,推理并合成其★ 210TFMQ-DMTFMQ-DM 是 CVPR 2024 Highlight 和 TPAMI 2025 论文的官方 PyTorch 实现,专注于扩散模型的训练后量化(PTQ)。扩★ 110diffindsceneDiffInDScene 是一个基于扩散模型的 3D 室内场景生成工具,来自 CVPR2024 论文。它解决的是从文本或布局描述自动生成高质量、多样化 3D 室★ 96amodalAmodal是CVPR 2024 Highlight论文《Amodal Completion via Progressive Mixed Context Dif★ 56