TAR3D
开源
像拼积木一样,逐部件预测生成高质量 3D 模型
TAR3D 是一个基于 ICCV 2025 论文的开源项目,旨在通过“下一部件预测”的方式生成高质量 3D 资产。···
汇聚全球AI数字人与3D生成项目,虚拟主播、数字分身、3D建模工具大全。
共收录 273 个开源项目
TAR3D
开源
像拼积木一样,逐部件预测生成高质量 3D 模型
TAR3D 是一个基于 ICCV 2025 论文的开源项目,旨在通过“下一部件预测”的方式生成高质量 3D 资产。···
GE3D
开源
用文本编辑3D模型,无需重新训练,快速出效果
GE3D是一个基于文本生成3D模型的早期开源项目,核心思路是通过2D编辑技术实现文本到3D的生成。它解···
BlenderLLM
开源
说句话,自动生成 Blender 3D 模型脚本
BlenderLLM 是一个专门根据用户自然语言指令生成 CAD 脚本的开源大语言模型。它解决的是从文本描述···
TRELLIS
开源
输入文本或图片,秒级生成可编辑的高质量 3D 模型
TRELLIS 是一个基于结构化 3D 潜空间的可扩展、多用途 3D 生成框架,源自 CVPR 2025 的 Spotlight ···
3DEnhancer
开源
一键提升 3D 模型质感,多视角细节更真实
3DEnhancer 是一个基于多视图扩散模型的 3D 增强工具,旨在解决 3D 重建或生成结果质量不佳的问题。···
float
开源
上传音频和照片,一键生成口型同步的逼真说话视频。
FLOAT 是一个基于 PyTorch 的音频驱动人像动画生成框架,论文发表于 ICCV 2025。它通过生成式运动潜···
echomimic_v2
开源
一张半身照,AI 帮你生动出镜说话
蚂蚁集团开源的半身人像动画生成模型(CVPR 2025),在 EchoMimic 基础上实现更自然、更简化的半身···
Open-DiffusionGS
开源
单张图片秒变3D模型,一步到位无需多阶段优化
Open-DiffusionGS 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的单阶段图像到 3D 生成与重建···
JoyVASA
开源
上传一张图,让照片和动物动起来说话
JoyVASA 是一个基于扩散模型的数字人动画生成框架,专注于人像和动物肖像的动画化。它解决了传统动···
GaussianAnything
开源
一句话生成可编辑的高质量 3D 高斯模型,告别粗糙网格
GaussianAnything 是一个基于原生 3D 扩散模型的 3D 内容生成项目,专注于生成高质量且可编辑的 su···
gaussian-dejavu
开源
单视频快速生成可控3D头像,泛化与个性化兼得
Gaussian Deja-vu 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的数字人头像创建框架,论文发···
VideoChat
开源
3秒低延迟,自定义形象音色,快速搭建你的实时数字人。
VideoChat 是一个基于 Python 的实时交互数字人开源项目,旨在解决传统数字人开发门槛高、交互延迟···
ProtoMotions
开源
让数字人和机器人学会真实物理运动,训练快人一步
ProtoMotions 是一个基于 GPU 加速的物理仿真与强化学习框架,专为训练物理模拟的数字人和人形机器···
DreamWaltz-G
开源
从单张图或文本,快速生成可动会笑的 3D 数字人
DreamWaltz-G 是一个基于 3D 高斯泼溅(3D Gaussian Splatting)的数字化身生成框架,由 TPAMI 202···
MeshAnythingV2
开源
把任意3D模型变成艺术家级干净网格,面少质高
MeshAnythingV2 是一个将任意3D表示(如点云、体素等)自动转换为艺术家级三角网格的开源项目,由I···
3DTopia-XL
开源
几秒生成带PBR材质的高质量3D模型,文本图片皆可
3DTopia-XL 是一个基于基元扩散(Primitive Diffusion)的高质量 3D PBR 资产生成框架,由复旦大学···
Animate3D
开源
上传静态3D模型,一键生成多视角动态动画视频。
Animate3D是NeurIPS 2024收录的开源项目,旨在将任意静态3D模型动画化。它利用多视角视频扩散模型,···
RodinHD
开源
单张照片秒变高保真3D数字人,可驱动可动画
RodinHD 是一个基于扩散模型的高保真 3D 数字人生成框架,由微软研究院和北京大学等机构联合提出,···
ScanTalk
开源
直接输入3D扫描,音频驱动生成说话头像动画
ScanTalk 是一个基于 ECCV 2024 论文的开源项目,专注于从非配准的 3D 扫描数据生成说话头部动画。···
echomimic
开源
上传音频和照片,一键生成逼真数字人说话视频,还能手动微调表情。
EchoMimic 是一个由 AAAI 2025 收录的音频驱动肖像动画生成项目,旨在通过音频和可编辑的面部关键点···
ScaleDreamer
开源
用文本快速生成高质量 3D 模型,省显存又高效
ScaleDreamer 是一个基于 ECCV2024 论文的可扩展文本到 3D 生成框架。它针对现有分数蒸馏方法在生成···
MeshAnything
开源
一键将任意3D数据转为艺术家级网格,告别杂乱拓扑
MeshAnything 是一个基于自回归 Transformer 的开源模型,旨在将任意 3D 表示(如点云、体素等)自···
Director3D
开源
输入一句话,自动生成真实3D场景和相机运镜视频
Director3D 是一个基于文本生成真实世界相机轨迹和 3D 场景的开源项目,来自 NeurIPS 2024 论文。它···
tet-splatting
开源
用四面体溅射技术,快速生成高质量3D模型。
Tetrahedron Splatting(四面体溅射)是一个用于3D生成的NeurIPS 2024 Spotlight开源项目。它提出了···