3d-reconstruction

本站收录 38 个带「3d-reconstruction」标签的 AI 开源项目

MeshroomMeshroom 是一款基于节点的开源三维重建软件,由 AliceVision 项目提供支持。它通过可视化节点图(Node Graph)将摄影测量(Photog★ 12,987openMVGopenMVG(open Multiple View Geometry)是一个用 C++ 编写的开源多视图几何库,主要面向三维计算机视觉与运动恢复结构(Stru★ 6,563AliceVisionAliceVision 是一套开源的 3D 计算机视觉框架,用 C++ 编写,核心目标是从多视角照片自动重建三维场景。它把摄影测量流程拆解成可组合的模块,覆盖特★ 3,506PartCrafterPartCrafter 是一个面向数字人与3D内容创作的开源项目,发表于 NeurIPS 2025。它提出了一种基于组合式潜在扩散 Transformer 的结★ 2,4853dgrut3dgrut 是 NVIDIA 开源的高斯粒子渲染框架,核心是把 3D Gaussian Splatting(3DGS)与光线追踪、混合光栅化结合,解决传统 3★ 2,446WorldGenWorldGen 是一个基于 Python 的 3D 场景生成工具,能在几秒钟内从文本描述或简单输入生成任意 3D 场景。它解决了传统 3D 建模耗时费力、门槛★ 2,149TripoSGTripoSG 是一个基于大规模修正流模型的高保真 3D 形状生成开源项目,由 Tripo AI 团队开发。它解决了从单张图片或文本描述快速生成高质量 3D 模★ 1,812Direct3D-S2Direct3D-S2 是一个面向超大规模 3D 内容生成的深度学习框架,核心创新在于空间稀疏注意力机制,解决了传统 3D 生成模型在体素或点云规模增大时计算复★ 1,284BoofCVBoofCV 是一个用纯 Java 编写的高性能计算机视觉库,主要面向机器人、移动端和嵌入式场景。它解决了 Java 生态中缺少可离线运行、无需本地依赖的视觉算★ 1,199Matrix-3DMatrix-3D 是一个从单张图片或文本提示生成大规模可探索 3D 场景的开源项目。它通过生成高质量的全景视频,让用户能够在虚拟 3D 空间中自由漫游。该项目★ 833TripoSFTripoSF 是一个基于 SparseFlex 方法的 3D 形状建模开源项目,专注于高分辨率与任意拓扑结构的 3D 生成。它解决了传统 3D 建模中分辨率受★ 769ReconViaGenReconViaGen 是一个面向多视图 3D 物体重建的生成式框架,由 ICLR 2026 论文提出。它解决传统重建方法在稀疏视图下精度低、几何细节缺失的问题★ 651SpatialVIDSpatialVID 是一个面向视频生成与空间智能研究的大规模视频数据集,由 CVPR 2026 论文提出。它解决了现有视频数据集缺乏空间标注、难以支撑 4D ★ 601VistaDreamVistaDream 是一个用于单视图场景重建的多视图一致图像采样工具,由 ICCV 2025 论文提出。它解决的是从单张图像生成多视角一致图像的问题,这是三维★ 541PhysX-3DPhysX-3D 是一个面向数字人领域的物理感知 3D 资产生成框架,由 NeurIPS 2025 Spotlight 论文支持。它解决的核心问题是:传统 3D★ 393GLAMRGLAMR是CVPR 2022 Oral论文的官方PyTorch实现,专注于动态相机下的全局遮挡感知人体网格恢复。它解决的是在复杂动态场景中,当人体被部分遮挡或★ 390EscherNetEscherNet是一个基于生成模型的视图合成工具,由CVPR 2024作为Oral论文提出。它解决了从少量输入图像生成多视角一致新视图的问题,核心能力在于其可★ 381VideoSceneVideoScene 是一个 CVPR 2025 Highlight 项目,旨在将视频扩散模型的知识蒸馏到前馈网络,实现一步生成 3D 场景。它解决传统 3D ★ 354video_to_worldvideo_to_world 是一个从视频扩散模型生成的三维世界中重建 3D 场景的开源项目。它解决的核心问题是:视频扩散模型生成的视频序列存在固有的三维不一致★ 316LangScene-XLangScene-X 是一个基于 TriMap 视频扩散模型的 3D 语言嵌入场景重建框架,由 ICCV 2025 论文提出。它解决的核心问题是:现有 3D ★ 302SIFUSIFU是CVPR 2024 Highlight论文的官方实现,专注于从单张RGB图像重建穿着衣服的3D人体模型。它解决的是真实世界场景下,传统方法因遮挡、复杂★ 275GShellGShell 是 ICLR 2024 Oral 论文《Ghost on the Shell: An Expressive Representation of G★ 261LN3DiffLN3Diff 是一个基于扩散模型的文本生成3D物体网格的开源项目,发表于 ECCV 2024。它解决了从文本描述直接生成高质量3D网格的难题,传统方法通常需要★ 229CupidCupid 是一个 CVPR'26 Highlight 论文的开源实现,核心目标是建立 2D 图像与相机参数之间的桥梁,从而生成高质量的 3D 内容。它解决了传★ 219GSFixerGSFixer 是一个基于参考图像引导的视频扩散先验来修复三维高斯泼溅(3D Gaussian Splatting)重建质量的开源项目,发表于 ICML 202★ 193Synthesize3DviaDepthOrSil这是一个2017年CVPR论文的开源实现,用于通过多视图深度图或轮廓图来生成和重建3D形状。项目核心是训练一个生成对抗网络(GAN)和变分自编码器(VAE)模型★ 170Awesome-Gaussian-SkillsAwesome-Gaussian-Skills 是一个面向 3D 高斯泼溅(3DGS)、NeRF 及计算机图形学研究者的 AI 智能体技能库,持续收录并分类整理★ 159ZeroShapeZeroShape是一个基于回归的零样本三维形状重建项目,旨在从单张图像直接恢复物体的三维几何结构。它解决了传统三维重建方法依赖大量标注数据、泛化能力差的问题,★ 141reflect3rReflect3r 是一个基于单张图像和镜面反射辅助的 3D 立体重建开源项目,由 3DV 2026 论文支撑。它解决的是传统单视图 3D 重建中因遮挡和视角单★ 120ObjaversePlusPlusObjaverse++ 是一个面向 3D 视觉研究的高质量 3D 物体数据集项目,由 Objaverse 扩展而来,收录了超过 10 万个 3D 物体,并附带质★ 114Human101Human101 是一个从单视角视频快速重建高保真 3D 数字人的开源项目,基于 3D Gaussian Splatting 技术,能在 100 秒内完成训练,★ 110epipolar-dpoEpipolar-DPO 是一个用于提升视频生成模型几何一致性的开源项目,其核心思想是利用极线几何(Epipolar Geometry)作为约束,通过直接偏好优★ 95CEB_ECONCEB_ECON 是一个基于 AI 的 Blender 插件,用于一键生成高质量 3D 角色。它整合了多个计算机视觉和图形学模型,从单张照片或简单输入中重建出完★ 93TAR3DTAR3D 是一个基于 ICCV 2025 论文的开源项目,旨在通过“下一部件预测”的方式生成高质量 3D 资产。它解决了传统 3D 生成方法中模型复杂、生成速★ 79EvoWorldEvoWorld 是一个基于显式 3D 记忆的渐进式全景世界生成框架,旨在解决长时程视频生成中场景一致性和记忆衰减问题。它通过将生成的世界状态编码为显式 3D ★ 76LATOLATO 是一个基于 ICML'26 论文的 3D 网格生成项目,核心是“流匹配”与“结构化拓扑保持潜空间”结合。它解决的是传统 3D 生成模型难以保持网格拓扑★ 74SPVDSPVD 是一个基于稀疏点体素扩散模型的高效可扩展点云生成框架。它针对现有扩散模型在大规模点云生成中计算开销大、内存占用高的问题,提出了一种结合点云与体素表征的★ 653DRAE3DRAE 是一个基于3D场景表示的开源项目,核心思想是将任意3D场景压缩为约1000个token,从而实现大规模场景生成。它解决的是传统3D场景生成中计算开销★ 59