3d-generation

本站收录 133 个带「3d-generation」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

Hunyuan3D-2Hunyuan3D-2 是腾讯开源的高分辨率 3D 资产生成模型,基于大规模扩散模型架构,能够从单张图片或文本描述直接生成高质量、带纹理的 3D 网格模型。它解★ 14,993TRELLISTRELLIS 是一个基于结构化 3D 潜空间的可扩展、多用途 3D 生成框架,源自 CVPR 2025 的 Spotlight 论文。它解决的核心问题是现有 ★ 13,730Wonder3DWonder3D是一个从单张图像生成高质量3D模型的AI项目,利用跨域扩散模型技术,将2D图片转换为带纹理的3D网格。它解决了传统单图3D重建中几何细节缺失和纹★ 5,435Hunyuan3D-2.1Hunyuan3D-2.1是腾讯开源的3D资产生成模型,能从单张图片生成高保真3D模型,并附带生产级PBR材质。它解决的是传统3D建模耗时费力、门槛高的问题,让★ 4,095DreamCraft3DDreamCraft3D 是一个由 ICLR 2024 收录的官方实现项目,专注于从单张 2D 图像生成高质量 3D 模型。它采用分层生成策略,结合引导扩散先验★ 3,028HunyuanWorld-1.0HunyuanWorld-1.0 是腾讯混元团队推出的3D世界生成模型,旨在从文本或图像直接生成沉浸式、可探索且可交互的3D世界。它解决了传统3D内容制作成本高★ 2,936PartCrafterPartCrafter 是一个面向数字人与3D内容创作的开源项目,发表于 NeurIPS 2025。它提出了一种基于组合式潜在扩散 Transformer 的结★ 2,485WorldGenWorldGen 是一个基于 Python 的 3D 场景生成工具,能在几秒钟内从文本描述或简单输入生成任意 3D 场景。它解决了传统 3D 建模耗时费力、门槛★ 2,149MotionGPTMotionGPT 是一个将人体运动视为一种‘外语’的统一生成模型,发表于 NeurIPS 2023。它利用大型语言模型(LLM)的架构来处理运动序列,将动作数★ 1,974Make-It-3DMake-It-3D 是 ICCV 2023 收录的论文官方实现,旨在从单张 2D 图像生成高质量、高保真的 3D 模型。它解决了传统 3D 内容创建依赖多视角★ 1,900TripoSGTripoSG 是一个基于大规模修正流模型的高保真 3D 形状生成开源项目,由 Tripo AI 团队开发。它解决了从单张图片或文本描述快速生成高质量 3D 模★ 1,812One-2-3-45One-2-3-45 是一个将单张 2D 图像快速转换为 3D 网格模型的开源项目,来自 NeurIPS 2023 论文。它解决了传统 3D 重建需要多视角图像★ 1,717Magic123Magic123 是一个由 ICLR'24 收录的官方 PyTorch 实现,专注于从单张图像生成高质量 3D 物体。它解决了传统单图 3D 重建中几何细节缺失★ 1,624HunyuanWorld-VoyagerHunyuanWorld-Voyager 是一个基于 RGBD 视频生成的交互式 3D 重建模型,由腾讯混元团队开源。它解决了从普通视频中实时重建 3D 场景的★ 1,599Hunyuan3D-2-WinPortableHunyuan3D-2-WinPortable 是腾讯混元3D 2.0/2.1模型的Windows便携整合包,旨在解决官方模型在Windows环境下部署复杂、依★ 1,335momask-codesMoMask 是 CVPR 2024 的官方实现,用于 3D 人体动作生成。它提出了一种基于掩码建模的生成框架,将动作序列离散化为量化码本,通过双向 Trans★ 1,320MV-AdapterMV-Adapter 是 ICCV 2025 的官方实现,旨在简化多视角一致图像生成任务。它解决了从单张图片或文本生成多个视角一致图像时,现有方法需要复杂训练或★ 1,291Direct3D-S2Direct3D-S2 是一个面向超大规模 3D 内容生成的深度学习框架,核心创新在于空间稀疏注意力机制,解决了传统 3D 生成模型在体素或点云规模增大时计算复★ 1,284cubeCube 是一个面向 3D 智能的 Roblox 基础模型,旨在让开发者通过自然语言或简单输入直接生成、编辑和交互 3D 内容。它解决了传统 3D 建模门槛高、★ 1,260LLaMA-MeshLLaMA-Mesh 是一个将 3D 网格生成与语言模型统一的开源项目,旨在让大语言模型直接生成可用的 3D 网格文件(如 OBJ 格式),无需依赖外部专用模型★ 1,173AvatarCLIPAvatarCLIP 是 SIGGRAPH 2022 的论文项目,实现零样本文本驱动的 3D 虚拟人生成与动画。它解决了传统 3D 虚拟人制作依赖手工建模、绑定★ 1,101text2roomText2Room 是一个利用 2D 文本生成图像模型来创建带纹理 3D 网格的开源项目,出自 ICCV2023。它解决了从单一文本提示直接生成连贯、可探索的 ★ 1,0913DTopia-XL3DTopia-XL 是一个基于基元扩散(Primitive Diffusion)的高质量 3D PBR 资产生成框架,由复旦大学和百度等机构联合推出,入选 C★ 1,048MeshAnythingV2MeshAnythingV2 是一个将任意3D表示(如点云、体素等)自动转换为艺术家级三角网格的开源项目,由ICCV 2025论文官方实现。它解决了现有3D重建★ 1,022awesome-3d-4d-world-models这是一个关于3D和4D世界建模的综述性资源列表,收录了TPAMI 2026论文《3D and 4D World Modeling: A Survey》中引用的相★ 993MotionDiffuseMotionDiffuse 是一个基于扩散模型的文本驱动人体运动生成框架,旨在解决从自然语言描述直接生成高质量3D人体动画的问题。它通过将文本编码器与去噪扩散模★ 984MIDI-3DMIDI-3D 是一个基于扩散模型的单图生成 3D 场景的开源项目,由 CVPR 2025 收录。它解决的是从单张 2D 图像直接生成多实例 3D 场景的难题,★ 950Open-DiffusionGSOpen-DiffusionGS 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的单阶段图像到 3D 生成与重建框架,论文发表于 IC★ 865DiffusionAsShaderDiffusionAsShader 是 SIGGRAPH 2025 论文的官方实现,提出将视频扩散模型视为可编程着色器,实现 3D 感知的视频生成控制。它解决传★ 842Matrix-3DMatrix-3D 是一个从单张图片或文本提示生成大规模可探索 3D 场景的开源项目。它通过生成高质量的全景视频,让用户能够在虚拟 3D 空间中自由漫游。该项目★ 833CraftsMan3DCraftsMan3D 是一个基于 3D 原生扩散模型的高保真网格生成工具,旨在解决从单张图片或文本描述生成高质量 3D 模型的问题。它通过 3D 原生扩散架构★ 831GameFactory-3AGameFactory-3A 是一个开源的 3A 游戏生成技能与资产框架,旨在为游戏开发者提供从概念到成品的全流程生成工具链。它整合了 3D 模型生成、图像生成★ 814TripoSFTripoSF 是一个基于 SparseFlex 方法的 3D 形状建模开源项目,专注于高分辨率与任意拓扑结构的 3D 生成。它解决了传统 3D 建模中分辨率受★ 769motion-latent-diffusionmotion-latent-diffusion 是一个基于潜在空间运动扩散模型的开源项目,发表于 CVPR 2023。它旨在解决文本或动作指令到人体运动生成的任★ 747Nova3DNova3D是一个开源的3D生成客户端,支持从文本或参考图像生成可编辑、部件感知的3D模型。它基于Flutter构建,集成了多种生成式AI能力,如OpenAI、★ 726CityDreamerCityDreamer 是 CVPR 2024 论文的官方实现,专注于生成无边界的三维城市模型。它采用组合式生成模型,将城市分解为建筑、道路、植被等独立模块,分★ 700Awesome-CVPR2026-CVPR2025-ICCV2025-CVPR2024-ECCV2026-ECCV2024-AIGC这是一个汇集CVPR、ICCV、ECCV等顶级计算机视觉会议中AIGC相关论文与代码的精选列表。项目旨在解决研究者难以系统追踪前沿AIGC成果的问题,按会议年份★ 676ReconViaGenReconViaGen 是一个面向多视图 3D 物体重建的生成式框架,由 ICLR 2026 论文提出。它解决传统重建方法在稀疏视图下精度低、几何细节缺失的问题★ 651Hunyuan3D-OmniHunyuan3D-Omni 是腾讯开源的统一框架,用于可控生成高质量3D资产。它解决了传统3D建模耗时费力、难以精细控制的问题,支持从文本、图像或两者结合生成★ 632Text2LightText2Light 是 SIGGRAPH Asia 2022 发表的零样本文本驱动 HDR 全景图生成模型。它解决的是从文本描述直接生成高质量、高动态范围(H★ 628SpatialVIDSpatialVID 是一个面向视频生成与空间智能研究的大规模视频数据集,由 CVPR 2026 论文提出。它解决了现有视频数据集缺乏空间标注、难以支撑 4D ★ 601XCubeXCube 是一个用于大规模 3D 生成的深度学习框架,核心创新在于利用稀疏体素层次结构(Sparse Voxel Hierarchies)来高效表示和生成高分★ 549Hunyuan3D-PartHunyuan3D-Part 是腾讯开源的 3D 部件分割与生成流水线,专注于将 3D 模型分解为语义部件(如椅子的腿、靠背),并支持基于部件的条件生成。它解决★ 544En3DEn3D 是 CVPR 2024 发表的论文官方实现,旨在从 2D 合成数据中生成高质量 3D 数字人。它解决传统 3D 人体生成依赖昂贵 3D 扫描数据、且生★ 543VistaDreamVistaDream 是一个用于单视图场景重建的多视图一致图像采样工具,由 ICCV 2025 论文提出。它解决的是从单张图像生成多视角一致图像的问题,这是三维★ 541sjcsjc(Score Jacobian Chaining)是CVPR 2023提出的3D生成方法,核心思路是利用预训练的2D扩散模型(如Stable Diffus★ 523SceneGenSceneGen 是一个基于单张图片、一次前向传播即可生成完整 3D 场景的开源项目,由 3DV 2026 论文提出。它解决了传统 3D 场景重建需要多视角输入★ 516AniGenAniGen 是一个面向可动画化 3D 资产生成的统一框架,由 SIGGRAPH 2026 论文提出。它解决了传统 3D 生成模型难以直接产出可驱动、可绑定角色★ 506GeoDreamGeoDream 是一个基于 Python 的 3D 生成项目,旨在从文本描述或单张图片生成高保真且多视角一致的 3D 模型。它通过解耦 2D 先验(如外观、纹★ 499Awesome-Try-On-Models这是一个虚拟试穿(Virtual Try-on)领域的资源聚合仓库,系统整理了相关论文、代码和工具。它解决的是虚拟试穿方向研究者和开发者信息分散、难以快速找到高★ 453