image-to-3d

本站收录 37 个带「image-to-3d」标签的 AI 开源项目

img2threejsimg2threejs 是一个将参考图片中的物体重建为纯代码、程序化、质量门控、可动画的 Three.js 模型的开源项目。它利用 AI 智能体(如 Claud★ 17,197Hunyuan3D-2Hunyuan3D-2 是腾讯开源的高分辨率 3D 资产生成模型,基于大规模扩散模型架构,能够从单张图片或文本描述直接生成高质量、带纹理的 3D 网格模型。它解★ 14,993TRELLISTRELLIS 是一个基于结构化 3D 潜空间的可扩展、多用途 3D 生成框架,源自 CVPR 2025 的 Spotlight 论文。它解决的核心问题是现有 ★ 13,730stable-dreamfusionstable-dreamfusion 是一个基于 NeRF 与扩散模型的开源 3D 生成工具,支持文本生成 3D、图像生成 3D 以及网格导出。它利用 Stab★ 8,863Hunyuan3D-2.1Hunyuan3D-2.1是腾讯开源的3D资产生成模型,能从单张图片生成高保真3D模型,并附带生产级PBR材质。它解决的是传统3D建模耗时费力、门槛高的问题,让★ 4,095zero123Zero-1-to-3(简称zero123)是一个基于稳定扩散(Stable Diffusion)的零样本单图转3D物体生成框架,由哥伦比亚大学等机构在ICCV★ 3,065DreamCraft3DDreamCraft3D 是一个由 ICLR 2024 收录的官方实现项目,专注于从单张 2D 图像生成高质量 3D 模型。它采用分层生成策略,结合引导扩散先验★ 3,028HunyuanWorld-1.0HunyuanWorld-1.0 是腾讯混元团队推出的3D世界生成模型,旨在从文本或图像直接生成沉浸式、可探索且可交互的3D世界。它解决了传统3D内容制作成本高★ 2,936PartCrafterPartCrafter 是一个面向数字人与3D内容创作的开源项目,发表于 NeurIPS 2025。它提出了一种基于组合式潜在扩散 Transformer 的结★ 2,485WorldGenWorldGen 是一个基于 Python 的 3D 场景生成工具,能在几秒钟内从文本描述或简单输入生成任意 3D 场景。它解决了传统 3D 建模耗时费力、门槛★ 2,149TripoSGTripoSG 是一个基于大规模修正流模型的高保真 3D 形状生成开源项目,由 Tripo AI 团队开发。它解决了从单张图片或文本描述快速生成高质量 3D 模★ 1,812Magic123Magic123 是一个由 ICLR'24 收录的官方 PyTorch 实现,专注于从单张图像生成高质量 3D 物体。它解决了传统单图 3D 重建中几何细节缺失★ 1,624HunyuanWorld-VoyagerHunyuanWorld-Voyager 是一个基于 RGBD 视频生成的交互式 3D 重建模型,由腾讯混元团队开源。它解决了从普通视频中实时重建 3D 场景的★ 1,599Hunyuan3D-2-WinPortableHunyuan3D-2-WinPortable 是腾讯混元3D 2.0/2.1模型的Windows便携整合包,旨在解决官方模型在Windows环境下部署复杂、依★ 1,335Direct3D-S2Direct3D-S2 是一个面向超大规模 3D 内容生成的深度学习框架,核心创新在于空间稀疏注意力机制,解决了传统 3D 生成模型在体素或点云规模增大时计算复★ 1,2843DTopia-XL3DTopia-XL 是一个基于基元扩散(Primitive Diffusion)的高质量 3D PBR 资产生成框架,由复旦大学和百度等机构联合推出,入选 C★ 1,048Open-DiffusionGSOpen-DiffusionGS 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的单阶段图像到 3D 生成与重建框架,论文发表于 IC★ 865Matrix-3DMatrix-3D 是一个从单张图片或文本提示生成大规模可探索 3D 场景的开源项目。它通过生成高质量的全景视频,让用户能够在虚拟 3D 空间中自由漫游。该项目★ 833TripoSFTripoSF 是一个基于 SparseFlex 方法的 3D 形状建模开源项目,专注于高分辨率与任意拓扑结构的 3D 生成。它解决了传统 3D 建模中分辨率受★ 769ReconViaGenReconViaGen 是一个面向多视图 3D 物体重建的生成式框架,由 ICLR 2026 论文提出。它解决传统重建方法在稀疏视图下精度低、几何细节缺失的问题★ 651Hunyuan3D-OmniHunyuan3D-Omni 是腾讯开源的统一框架,用于可控生成高质量3D资产。它解决了传统3D建模耗时费力、难以精细控制的问题,支持从文本、图像或两者结合生成★ 632SceneGenSceneGen 是一个基于单张图片、一次前向传播即可生成完整 3D 场景的开源项目,由 3DV 2026 论文提出。它解决了传统 3D 场景重建需要多视角输入★ 516ComfyUI-Hunyuan3d-2-1ComfyUI-Hunyuan3d-2-1 是一个将腾讯混元3D v2.1模型集成到ComfyUI的插件,旨在通过ComfyUI的节点式工作流,实现从单张图片或★ 380NeuralLift-360NeuralLift-360 是一个将单张 2D 照片提升为 360° 可旋转 3D 对象的 CVPR 2023 项目。它解决了从任意自然照片(in-the-w★ 318Kiss3DGenKiss3DGen 是一个基于 CVPR 2025 论文的官方实现,旨在复用图像扩散模型来生成 3D 资产。它解决了传统 3D 生成方法需要大量 3D 训练数据★ 298Awesome-AvatarsAwesome-Avatars 是一个聚焦于人类虚拟形象(Avatar)前沿技术的精选列表,涵盖生成、重建与编辑三大方向。项目系统梳理了基于 NeRF、3DGS★ 276CASTCAST 是 SIGGRAPH 2025 最佳论文提名论文的非官方简化实现,目标是从单张 RGB 图像重建组件对齐的 3D 场景。它解决的核心问题是传统 3D ★ 256three.wsthree.ws 是一个开源的 3D AI 智能体框架,基于 Three.js 构建,支持加载 GLB/glTF 格式的 3D 角色模型,并为这些角色赋予大语言★ 217zero123-hfzero123-hf 是 Zero-1-to-3 模型的 diffusers 实现,该模型在 ICCV 2023 上提出,核心能力是从单张 RGB 图像零样本生★ 154ZeroShapeZeroShape是一个基于回归的零样本三维形状重建项目,旨在从单张图像直接恢复物体的三维几何结构。它解决了传统三维重建方法依赖大量标注数据、泛化能力差的问题,★ 141ComfyUI-Lux3DComfyUI-Lux3D 是一个 ComfyUI 扩展,旨在工作流中直接生成和渲染 3D 模型。它解决的是在 ComfyUI 生态中缺乏原生 3D 资产创建与★ 130GVGENGVGEN 是一个基于体积表示的文字生成 3D 模型的开源项目,发表于 ECCV 2024。它解决了从文本描述直接生成高质量 3D 模型的问题,特别是针对数字人★ 122meshy-3d-agentmeshy-3d-agent 是一个面向 Meshy AI 3D 生成平台的智能体技能集,基于 Python 开发,旨在将 Meshy 的文本/图像生成 3D ★ 96FlexiDreamerFlexiDreamer 是一个基于 FlexiCubes 的单图生成 3D 模型的官方实现,属于 AIGC 与 3D 生成领域。它解决的是从单张 2D 图像快★ 79TAR3DTAR3D 是一个基于 ICCV 2025 论文的开源项目,旨在通过“下一部件预测”的方式生成高质量 3D 资产。它解决了传统 3D 生成方法中模型复杂、生成速★ 79Customize-it-3DCustomize-It-3D 是 ICRA 2025 的官方实现,解决从单张图像生成高质量 3D 模型的难题。传统方法依赖大规模预训练模型,但缺乏对特定物体类★ 75AR123AR123 是 ICCV 2025 论文《AR-1-to-3: Single Image to Consistent 3D Object Generation ★ 64