3d

本站收录 70 个带「3d」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

editoreditor 是一个开源的三维建筑编辑器,面向建筑师、设计师和 AI 智能体。它把传统 3D 建模能力与本地优先(local-first)架构结合,提供本地 C★ 24,365img2threejsimg2threejs 是一个将参考图片中的物体重建为纯代码、程序化、质量门控、可动画的 Three.js 模型的开源项目。它利用 AI 智能体(如 Claud★ 17,197Hunyuan3D-2Hunyuan3D-2 是腾讯开源的高分辨率 3D 资产生成模型,基于大规模扩散模型架构,能够从单张图片或文本描述直接生成高质量、带纹理的 3D 网格模型。它解★ 14,993TRELLISTRELLIS 是一个基于结构化 3D 潜空间的可扩展、多用途 3D 生成框架,源自 CVPR 2025 的 Spotlight 论文。它解决的核心问题是现有 ★ 13,730Hunyuan3D-2.1Hunyuan3D-2.1是腾讯开源的3D资产生成模型,能从单张图片生成高保真3D模型,并附带生产级PBR材质。它解决的是传统3D建模耗时费力、门槛高的问题,让★ 4,095HunyuanWorld-1.0HunyuanWorld-1.0 是腾讯混元团队推出的3D世界生成模型,旨在从文本或图像直接生成沉浸式、可探索且可交互的3D世界。它解决了传统3D内容制作成本高★ 2,936PartCrafterPartCrafter 是一个面向数字人与3D内容创作的开源项目,发表于 NeurIPS 2025。它提出了一种基于组合式潜在扩散 Transformer 的结★ 2,485MeshAnythingMeshAnything 是一个基于自回归 Transformer 的开源模型,旨在将任意 3D 表示(如点云、体素等)自动转换为艺术家风格的高质量网格(Mes★ 2,309comfyui-mixlab-nodesMixlab Nodes 是一个 ComfyUI 的扩展节点包,旨在将 ComfyUI 从专业工作流工具升级为更易用的应用平台。它解决了 ComfyUI 原生界★ 1,862One-2-3-45One-2-3-45 是一个将单张 2D 图像快速转换为 3D 网格模型的开源项目,来自 NeurIPS 2023 论文。它解决了传统 3D 重建需要多视角图像★ 1,717HunyuanWorld-VoyagerHunyuanWorld-Voyager 是一个基于 RGBD 视频生成的交互式 3D 重建模型,由腾讯混元团队开源。它解决了从普通视频中实时重建 3D 场景的★ 1,599Hunyuan3D-2-WinPortableHunyuan3D-2-WinPortable 是腾讯混元3D 2.0/2.1模型的Windows便携整合包,旨在解决官方模型在Windows环境下部署复杂、依★ 1,335cubeCube 是一个面向 3D 智能的 Roblox 基础模型,旨在让开发者通过自然语言或简单输入直接生成、编辑和交互 3D 内容。它解决了传统 3D 建模门槛高、★ 1,260curvcurv 是一门专为数学艺术创作设计的编程语言,基于 C++ 实现。它解决了用传统编程语言表达复杂几何形状和动画时代码冗长、抽象层次低的问题,让艺术家和设计师能★ 1,165PointLLMPointLLM 是一个让大语言模型直接理解三维点云的开源多模态模型,解决了传统大模型只能处理文本和图像、无法感知三维结构的问题。它首次将点云编码器与 LLaM★ 1,056MeshAnythingV2MeshAnythingV2 是一个将任意3D表示(如点云、体素等)自动转换为艺术家级三角网格的开源项目,由ICCV 2025论文官方实现。它解决了现有3D重建★ 1,022awesome-3d-4d-world-models这是一个关于3D和4D世界建模的综述性资源列表,收录了TPAMI 2026论文《3D and 4D World Modeling: A Survey》中引用的相★ 993MIDI-3DMIDI-3D 是一个基于扩散模型的单图生成 3D 场景的开源项目,由 CVPR 2025 收录。它解决的是从单张 2D 图像直接生成多实例 3D 场景的难题,★ 950Awesome-Robotics-3DAwesome-Robotics-3D 是一个精选资源列表,专注于大模型(LLM/VLM)时代下机器人领域的 3D 视觉研究。它系统整理了相关论文、代码和网站,★ 825SolidUISolidUI 是一个基于 AIGC 的图形生成框架,用户只需输入一句自然语言描述,即可自动生成对应的 2D 或 3D 可视化图表。它解决了传统数据可视化开发中★ 687ReconViaGenReconViaGen 是一个面向多视图 3D 物体重建的生成式框架,由 ICLR 2026 论文提出。它解决传统重建方法在稀疏视图下精度低、几何细节缺失的问题★ 651Hunyuan3D-OmniHunyuan3D-Omni 是腾讯开源的统一框架,用于可控生成高质量3D资产。它解决了传统3D建模耗时费力、难以精细控制的问题,支持从文本、图像或两者结合生成★ 632heerichheerich 是一个极简的 3D 体素场景渲染引擎,专门将体素模型输出为 SVG 矢量图形。它解决了在 Web 环境中生成可缩放、可编辑的等距或透视风格 3D★ 617FabricFabric 是一个受 Quartz Composer 启发的节点式创意编程工具,使用 Swift 编写,面向 macOS 平台。它把 3D 渲染、图像处理、计★ 570AlbumentationsXAlbumentationsX 是经典图像增强库 Albumentations 的延续版本,面向计算机视觉训练场景,提供高性能、多样化的数据增强能力。它解决的核★ 563Hunyuan3D-PartHunyuan3D-Part 是腾讯开源的 3D 部件分割与生成流水线,专注于将 3D 模型分解为语义部件(如椅子的腿、靠背),并支持基于部件的条件生成。它解决★ 544SceneGenSceneGen 是一个基于单张图片、一次前向传播即可生成完整 3D 场景的开源项目,由 3DV 2026 论文提出。它解决了传统 3D 场景重建需要多视角输入★ 516GeoDreamGeoDream 是一个基于 Python 的 3D 生成项目,旨在从文本描述或单张图片生成高保真且多视角一致的 3D 模型。它通过解耦 2D 先验(如外观、纹★ 499awesome-vla-for-ad这是一个聚焦视觉-语言-动作模型(VLA)在自动驾驶领域应用的精选资源列表,系统梳理了该方向从过去到未来的研究脉络。项目解决了自动驾驶领域研究者难以快速获取VL★ 483TesserActTesserAct 是 ICCV 2025 收录的 4D 具身世界模型项目,旨在解决机器人或具身智能体对动态三维世界的理解与预测问题。它通过将视频生成与 3D/★ 409PhysX-3DPhysX-3D 是一个面向数字人领域的物理感知 3D 资产生成框架,由 NeurIPS 2025 Spotlight 论文支持。它解决的核心问题是:传统 3D★ 393Director3DDirector3D 是一个基于文本生成真实世界相机轨迹和 3D 场景的开源项目,来自 NeurIPS 2024 论文。它解决的是从单一文本描述直接合成动态 3★ 382ComfyUI-Hunyuan3d-2-1ComfyUI-Hunyuan3d-2-1 是一个将腾讯混元3D v2.1模型集成到ComfyUI的插件,旨在通过ComfyUI的节点式工作流,实现从单张图片或★ 380MVEditMVEdit 是一个基于 3D-Adapter 方法的多视角扩散模型项目,旨在解决从文本或单图生成高质量、几何一致的 3D 内容的问题。它通过在多视角扩散过程中★ 348MeshXLMeshXL 是一个基于神经坐标场(Neural Coordinate Field)的3D网格生成基础模型,由 NeurIPS 2024 论文提出。它解决了传统★ 341Awesome-Physics-Cognition-based-Video-Generation这是一个聚焦视频生成中物理认知方向的论文列表,旨在系统梳理该交叉领域的研究进展。它解决了研究者难以快速获取物理感知视频生成相关论文、代码和资源的问题。项目按主题★ 327OpenShape_codeOpenShape是面向开放世界3D形状理解的表示学习框架,旨在解决传统3D模型在类别覆盖和语义泛化上的局限。其核心思路是通过大规模多模态数据对齐训练,将点云、★ 321WorldFoundryWorldFoundry 是一个面向世界模型(World Model)的统一推理与评估基础设施,旨在解决视频生成、视觉-语言-动作(VLA)及世界动作模型(WA★ 318Awesome-Interactive-World-Model这是一个关于交互式世界模型的论文与资源精选列表,旨在系统梳理该领域的前沿研究。项目按核心研究挑战(如3D、扩散模型、流式视频、数据集等)对论文进行分类,帮助研究★ 308swifty-creativesswifty-creatives 是一个基于 Apple Metal 的 Swift 创意编程框架,灵感来自 Processing,专为艺术家、设计师和开发者打★ 300gcdGCD(Generative Camera Dolly)是ECCV 2024 Oral的官方实现,专注于极端单目动态新视角合成。它解决的是从单个移动摄像头拍摄的★ 292Outfit-Anyone-in-the-WildOutfit Anyone in the Wild 是一个基于 Stable Diffusion 的虚拟试穿开源项目,旨在解决传统虚拟试穿中受限于固定姿势、背景★ 269WorldLensWorldLens 是一个面向自动驾驶世界模型的全面评测框架,由 CVPR 2026 Oral 论文提出。它旨在解决当前驾驶世界模型评估标准单一、缺乏真实世界关★ 253VoxHammerVoxHammer 是一个无需训练的 3D 编辑工具,直接作用于原生 3D 空间(体素表示),实现精确且连贯的 3D 编辑。它解决了现有 3D 编辑方法依赖 2★ 243pix2gestaltpix2gestalt 是 CVPR 2024 论文的开源代码,专注于模态补全(amodal completion)任务,即从部分可见的物体图像中,推理并合成其★ 210SCoPESCoPE 是一个面向三维感知视频生成的开源研究项目,核心是提出「视线坐标位置编码」(Sightline-Coordinate Positional Encod★ 208Token-PrintToken-Print 是一个交互式 3D 可视化平台,专为探索 Transformer 架构、张量以及实时 LLM 推理过程而设计。它通过三维空间直观展示模型★ 204portfolio-website这是一个基于 React、TypeScript、Three.js、GSAP 和 WebGL 构建的交互式 3D 开发者个人作品集网站。它解决了开发者个人网站缺乏★ 176Synthesize3DviaDepthOrSil这是一个2017年CVPR论文的开源实现,用于通过多视图深度图或轮廓图来生成和重建3D形状。项目核心是训练一个生成对抗网络(GAN)和变分自编码器(VAE)模型★ 170wdm-3dWDM-3D 是一个基于 PyTorch 的 3D 小波扩散模型,用于高分辨率医学图像合成,论文发表于 MICCAI 2024。它针对医学图像(如 CT、MRI★ 141