text-to-3d

本站收录 33 个带「text-to-3d」标签的 AI 开源项目

Hunyuan3D-2Hunyuan3D-2 是腾讯开源的高分辨率 3D 资产生成模型,基于大规模扩散模型架构,能够从单张图片或文本描述直接生成高质量、带纹理的 3D 网格模型。它解★ 14,993TRELLISTRELLIS 是一个基于结构化 3D 潜空间的可扩展、多用途 3D 生成框架,源自 CVPR 2025 的 Spotlight 论文。它解决的核心问题是现有 ★ 13,730stable-dreamfusionstable-dreamfusion 是一个基于 NeRF 与扩散模型的开源 3D 生成工具,支持文本生成 3D、图像生成 3D 以及网格导出。它利用 Stab★ 8,863Hunyuan3D-2.1Hunyuan3D-2.1是腾讯开源的3D资产生成模型,能从单张图片生成高保真3D模型,并附带生产级PBR材质。它解决的是传统3D建模耗时费力、门槛高的问题,让★ 4,095Diffusion-Models-Papers-Survey-Taxonomy扩散模型论文、综述与分类体系的精选资料库,系统梳理扩散模型领域的研究脉络与分类框架,是快速入门与持续跟踪该领域进展的必备导航工具。★ 3,364HunyuanWorld-1.0HunyuanWorld-1.0 是腾讯混元团队推出的3D世界生成模型,旨在从文本或图像直接生成沉浸式、可探索且可交互的3D世界。它解决了传统3D内容制作成本高★ 2,936WorldGenWorldGen 是一个基于 Python 的 3D 场景生成工具,能在几秒钟内从文本描述或简单输入生成任意 3D 场景。它解决了传统 3D 建模耗时费力、门槛★ 2,149Hunyuan3D-2-WinPortableHunyuan3D-2-WinPortable 是腾讯混元3D 2.0/2.1模型的Windows便携整合包,旨在解决官方模型在Windows环境下部署复杂、依★ 1,335cubeCube 是一个面向 3D 智能的 Roblox 基础模型,旨在让开发者通过自然语言或简单输入直接生成、编辑和交互 3D 内容。它解决了传统 3D 建模门槛高、★ 1,2603DTopia-XL3DTopia-XL 是一个基于基元扩散(Primitive Diffusion)的高质量 3D PBR 资产生成框架,由复旦大学和百度等机构联合推出,入选 C★ 1,048Multi-Agent-CADMulti-Agent-CAD(简称 MAC)是一个面向文本到 CAD 生成的开源多智能体框架,目标是把自然语言需求自动转成可编辑、可制造的 3D CAD 模型★ 1,006Open-DiffusionGSOpen-DiffusionGS 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的单阶段图像到 3D 生成与重建框架,论文发表于 IC★ 865Matrix-3DMatrix-3D 是一个从单张图片或文本提示生成大规模可探索 3D 场景的开源项目。它通过生成高质量的全景视频,让用户能够在虚拟 3D 空间中自由漫游。该项目★ 833HolodeckHolodeck 是一个基于 CVPR 2024 论文的开源项目,旨在通过自然语言指令自动生成 3D 具身 AI 环境。它解决了传统 3D 环境构建耗时费力的问★ 576Awesome-LLMs-meet-Multimodal-Generation这是一个精选论文列表,聚焦于基于大语言模型(LLM)的多模态生成领域,涵盖图像、视频、3D和音频四大模态。项目系统梳理了LLM与多模态生成结合的前沿研究,包括多★ 552GeoDreamGeoDream 是一个基于 Python 的 3D 生成项目,旨在从文本描述或单张图片生成高保真且多视角一致的 3D 模型。它通过解耦 2D 先验(如外观、纹★ 499Director3DDirector3D 是一个基于文本生成真实世界相机轨迹和 3D 场景的开源项目,来自 NeurIPS 2024 论文。它解决的是从单一文本描述直接合成动态 3★ 382ProceduraProcedura 是一个将文本提示转化为可编辑参数化程序的智能体式 3D 建模工具。它解决的是传统文本生成 3D 模型难以二次编辑和控制的痛点,通过 LLM ★ 338NeuralLift-360NeuralLift-360 是一个将单张 2D 照片提升为 360° 可旋转 3D 对象的 CVPR 2023 项目。它解决了从任意自然照片(in-the-w★ 318Kiss3DGenKiss3DGen 是一个基于 CVPR 2025 论文的官方实现,旨在复用图像扩散模型来生成 3D 资产。它解决了传统 3D 生成方法需要大量 3D 训练数据★ 298Awesome-AvatarsAwesome-Avatars 是一个聚焦于人类虚拟形象(Avatar)前沿技术的精选列表,涵盖生成、重建与编辑三大方向。项目系统梳理了基于 NeRF、3DGS★ 276DreamSceneDreamScene 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的文本生成 3D 场景的开源项目,发表于 ECCV 2024。它解★ 232three.wsthree.ws 是一个开源的 3D AI 智能体框架,基于 Three.js 构建,支持加载 GLB/glTF 格式的 3D 角色模型,并为这些角色赋予大语言★ 217GVGENGVGEN 是一个基于体积表示的文字生成 3D 模型的开源项目,发表于 ECCV 2024。它解决了从文本描述直接生成高质量 3D 模型的问题,特别是针对数字人★ 122HeadSculptHeadSculpt 是一个基于文本生成 3D 头部头像的开源项目,发表于 NeurIPS 2023。它解决的核心问题是如何仅通过文字描述快速创建高质量、可编辑★ 116GE3DGE3D是一个基于文本生成3D模型的早期开源项目,核心思路是通过2D编辑技术实现文本到3D的生成。它解决的是传统文本转3D方法中生成速度慢、几何细节粗糙、编辑能★ 112meshy-3d-agentmeshy-3d-agent 是一个面向 Meshy AI 3D 生成平台的智能体技能集,基于 Python 开发,旨在将 Meshy 的文本/图像生成 3D ★ 96Bootstrap3DBootstrap3D 是一个针对多视图扩散模型的训练框架,旨在通过合成数据提升模型生成 3D 内容的质量。它解决了真实多视图数据稀缺、采集成本高的问题,利用大★ 94MatlaberMATLABER 是一个基于扩散模型的文本生成 3D 内容的开源项目,核心创新在于将材质(BRDF)信息隐式编码到潜在空间中,实现材质感知的文本到 3D 生成。★ 93TAR3DTAR3D 是一个基于 ICCV 2025 论文的开源项目,旨在通过“下一部件预测”的方式生成高质量 3D 资产。它解决了传统 3D 生成方法中模型复杂、生成速★ 79DiffusionGAN3DDiffusionGAN3D 是一个 CVPR 2024 论文的开源实现,旨在结合 3D GAN 和扩散先验,提升文本引导的 3D 生成质量,并支持领域自适应。★ 70STARSTAR 是一个基于文本描述生成 4D 数字人(含骨骼动画)的开源项目,核心解决“文字直接驱动 3D 角色动画”的难题。它提出骨骼感知的文本到 4D 化身生成框★ 65ScaleDreamerScaleDreamer 是一个基于 ECCV2024 论文的可扩展文本到 3D 生成框架。它针对现有分数蒸馏方法在生成高分辨率、大场景 3D 内容时计算开销大★ 54