MeshXL
开源
直接生成高质量3D网格,告别繁琐后处理
MeshXL 是一个基于神经坐标场(Neural Coordinate Field)的3D网格生成基础模型,由 NeurIPS 2024 ···
汇聚全球AI数字人与3D生成项目,虚拟主播、数字分身、3D建模工具大全。
共收录 273 个开源项目
MeshXL
开源
直接生成高质量3D网格,告别繁琐后处理
MeshXL 是一个基于神经坐标场(Neural Coordinate Field)的3D网格生成基础模型,由 NeurIPS 2024 ···
GaussianCity
开源
一句话生成无边界3D城市,实时漫游
GaussianCity 是 CVPR 2025 的官方实现,专注于无边界 3D 城市生成。它利用 3D 高斯泼溅(Gaussian···
XCube
开源
用稀疏体素层次结构,高效生成高分辨率 3D 模型
XCube 是一个用于大规模 3D 生成的深度学习框架,核心创新在于利用稀疏体素层次结构(Sparse Voxel···
CraftsMan3D
开源
从图片或文字一键生成可编辑的高保真 3D 网格
CraftsMan3D 是一个基于 3D 原生扩散模型的高保真网格生成工具,旨在解决从单张图片或文本描述生成···
Duix-Mobile
开源
在手机端实现1.5秒内响应的3D AI数字人,本地部署更安全
Duix-Mobile 是一款面向移动端和边缘设备的实时交互式 AI 数字人(3D 虚拟形象)解决方案,主打本地···
NeRFFaceSpeech_Code
开源
单张照片+语音,生成逼真3D说话头像
NeRFFaceSpeech_Code 是一个基于 NeRF(神经辐射场)的 3D 说话头生成开源项目,对应 CVPRW 2024 论···
MiniGPT-3D
开源
一张3090显卡,让大模型看懂3D点云并对话
MiniGPT-3D 是一个面向 3D 点云理解与对话的开源项目,旨在让大语言模型(LLM)直接理解三维空间信···
easi-tex
开源
单张图秒变 3D 纹理,边缘细节不糊掉
EASI-Tex 是一个基于深度学习的网格纹理生成工具,其核心功能是从单张图像自动生成高质量的 3D 网格···
DigitalLife
开源
给AI装上记忆和Live2D身体,打造能记住你的虚拟生命
DigitalLife 是一个开源的“数字生命”项目,旨在通过结合 Live2D 形象、长期记忆和 AI 对话能力,···
STAR
开源
输入文字,直接生成带骨骼动画的 4D 数字人,无需手动绑定
STAR 是一个基于文本描述生成 4D 数字人(含骨骼动画)的开源项目,核心解决“文字直接驱动 3D 角色···
lobe-vidol
开源
拖拽搭建专属虚拟偶像,会聊天能唱歌
Lobe Vidol 是一个让每个人都能轻松创建和使用虚拟偶像的开源框架。它解决了虚拟偶像制作门槛高、技···
EDTalk
开源
可编辑的说话人脸生成,姿态表情口型随心控
EDTalk是一款基于ECCV 2024 Oral论文的官方PyTorch实现,专注于高保真、可编辑的说话人脸视频生成。···
Gamba
开源
单张图片,秒级生成3D模型,高效重建新范式
Gamba 是一个基于 PyTorch 实现的单视图 3D 重建项目,核心思想是将高斯泼溅(Gaussian Splatting)···
FlexiDreamer
开源
单张照片秒变 3D 模型,用 FlexiCubes 快速生成网格。
FlexiDreamer 是一个基于 FlexiCubes 的单图生成 3D 模型的官方实现,属于 AIGC 与 3D 生成领域。它···
ASH
开源
用高斯泼溅技术,实现高效逼真的可驱动数字人渲染。
ASH 是 CVPR 2024 论文《Ash: Animatable Gaussian Splats for Efficient and Photoreal Human Ren···
GaussianCube
开源
把3D高斯塞进立方体,让生成模型直接吃,又快又稳
GaussianCube 是 NeurIPS 2024 提出的结构化显式辐射场表示方法,旨在解决 3D 生成建模中隐式表示(···
GVGEN
开源
输入文字,一键生成3D数字人模型
GVGEN 是一个基于体积表示的文字生成 3D 模型的开源项目,发表于 ECCV 2024。它解决了从文本描述直···
LN3Diff
开源
8秒文本生成3D网格,效率提升数十倍
LN3Diff 是一个基于扩散模型的文本生成3D物体网格的开源项目,发表于 ECCV 2024。它解决了从文本描···
DreamScene
开源
输入一句话,自动生成多物体 3D 场景,布局合理不打架
DreamScene 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的文本生成 3D 场景的开源项目,发表···
Arc2Face
开源
一张照片,生成身份一致的多表情人脸图
Arc2Face 是一个基于扩散模型的人脸生成基础模型,核心解决身份一致性问题。它利用 ArcFace 预训练···
MVEdit
开源
让 AI 生成 3D 模型时,多视角不再“穿帮”,几何更一致。
MVEdit 是一个基于 3D-Adapter 方法的多视角扩散模型项目,旨在解决从文本或单图生成高质量、几何一···
IPDreamer
开源
上传复杂图片,一键生成可控外观的3D模型
IPDreamer是一个基于ICLR 2025论文的开源项目,专注于外观可控的3D物体生成。它解决的核心问题是:···
ZerolanLiveRobot
开源
让 AI 虚拟主播自动直播、陪你玩 MC,全栈 AI 驱动
ZerolanLiveRobot 是一个基于 Python 的 AI 虚拟主播(VTuber)开源项目,旨在通过集成大语言模型(···
ShapeLLM
开源
让 AI 看懂并操作 3D 物体,赋能机器人交互
ShapeLLM 是一个面向具身交互的通用 3D 物体理解模型,由 ECCV 2024 论文提出。它解决了传统 3D 模···