VoxHammer
开源
无需训练,直接在 3D 空间里精准编辑模型
VoxHammer 是一个无需训练的 3D 编辑工具,直接作用于原生 3D 空间(体素表示),实现精确且连贯的···
汇聚全球AI数字人与3D生成项目,虚拟主播、数字分身、3D建模工具大全。
共收录 273 个开源项目
VoxHammer
开源
无需训练,直接在 3D 空间里精准编辑模型
VoxHammer 是一个无需训练的 3D 编辑工具,直接作用于原生 3D 空间(体素表示),实现精确且连贯的···
SpatialGen
开源
给个布局,自动生成逼真3D室内场景
SpatialGen 是一个基于布局引导的 3D 室内场景生成框架,来自 3DV 2026 论文。它解决的核心问题是:···
SceneGen
开源
单张照片,一次前向,秒出完整 3D 场景
SceneGen 是一个基于单张图片、一次前向传播即可生成完整 3D 场景的开源项目,由 3DV 2026 论文提出···
fantasy-talking2
开源
上传音频和照片,生成唇形精准、表情自然的说话视频
FantasyTalking2 是一个基于扩散模型的音频驱动人像动画生成项目,发表于 AAAI 2026。它解决的是传···
Matrix-3D
开源
一张图或一句话,生成可漫游的 3D 全景场景
Matrix-3D 是一个从单张图片或文本提示生成大规模可探索 3D 场景的开源项目。它通过生成高质量的全···
一张图加一段音频,生成无限时长数字人视频
StableAvatar 是一个基于视频扩散 Transformer 的端到端数字人视频生成框架,只需输入一张参考图和···
HoloMotion
开源
一句话生成人形机器人全身动作,让机器人动起来更自然。
HoloMotion 是一个面向全身人形机器人控制的基础模型,旨在解决人形机器人全身协调运动控制的难题。···
像搭积木一样拼出能听会说有记忆的实时数字人
AlphaAvatar 是一个基于 LiveKit 构建的实时交互式全模态数字人框架,目标是把数字人拆解成可插拔的···
echomimic_v3
开源
1.3B小模型搞定数字人,音频文本驱动全身动画
EchoMimicV3 是一个面向数字人动画生成的开源项目,由 AAAI 2026 论文提出,核心思路是用 1.3B 参数···
MoDA
开源
一张照片加一段语音,生成口型同步的数字人视频
MoDA 是一个基于多模态扩散架构的说话头生成(Talking Head Generation)项目。它解决的是如何从单···
HunyuanWorld-1.0
开源
一句话或一张图,生成可探索交互的3D世界
HunyuanWorld-1.0 是腾讯混元团队推出的3D世界生成模型,旨在从文本或图像直接生成沉浸式、可探索且···
PhysX-3D
开源
生成能真实物理交互的3D资产,让数字人动起来更自然
PhysX-3D 是一个面向数字人领域的物理感知 3D 资产生成框架,由 NeurIPS 2025 Spotlight 论文支持。···
LangScene-X
开源
用视频扩散模型,一句话重建带语义的 3D 场景
LangScene-X 是一个基于 TriMap 视频扩散模型的 3D 语言嵌入场景重建框架,由 ICCV 2025 论文提出。···
MotionGPT3
开源
让AI看懂并生成人体动作,运动与语言无缝互通
MotionGPT3 是一个基于多模态大语言模型(MoT)框架的开源项目,旨在将人体运动作为第二种模态,与···
DIMO
开源
给任意3D物体一键生成多种自然运动,动画制作快人一步
DIMO是一个面向任意物体的多样化3D运动生成框架,由ICCV 2025收录并评为Highlight。它解决了现有4D···
anima-x
开源
让静态 3D 模型动起来,一键迁移视频动作
AnimaX 是一个将静态 3D 模型或非生命物体赋予生命力的开源项目,基于论文《AnimaX: Animating the···
awesome-3d-4d-world-models
开源
一页看尽3D/4D世界模型前沿论文,快速入门不迷路
这是一个关于3D和4D世界建模的综述性资源列表,收录了TPAMI 2026论文《3D and 4D World Modeling: ···
ComfyUI-Hunyuan3d-2-1
开源
在ComfyUI里,一张图秒变带PBR材质的3D模型
ComfyUI-Hunyuan3d-2-1 是一个将腾讯混元3D v2.1模型集成到ComfyUI的插件,旨在通过ComfyUI的节点式···
Hunyuan3D-2.1
开源
一张图,秒出带PBR材质的3D模型,直接进生产管线
Hunyuan3D-2.1是腾讯开源的3D资产生成模型,能从单张图片生成高保真3D模型,并附带生产级PBR材质。···
PartCrafter
开源
一句话生成带部件结构的3D网格,可编辑可重组
PartCrafter 是一个面向数字人与3D内容创作的开源项目,发表于 NeurIPS 2025。它提出了一种基于组合···
SimulatedSelf
开源
摄像头前动一动,3D 分身实时跟你学。
运行在浏览器中的实时数字孪生:网络摄像头驱动 3D 人形,同步你的肢体动作、识别你的情绪,并通过···
respace
开源
输入一句话,自动生成或编辑室内 3D 场景
ReSpace 是一个基于文本驱动的自回归 3D 室内场景生成与编辑的开源项目,对应论文《ReSpace: Text-···
Direct3D-S2
开源
一句话文本/图片,秒级生成超大细节3D模型
Direct3D-S2 是一个面向超大规模 3D 内容生成的深度学习框架,核心创新在于空间稀疏注意力机制,解···
StableGen
开源
在 Blender 里用 AI 一键生成纹理,告别繁琐贴图流程
StableGen 是一个集成在 Blender 中的生成式 AI 纹理工作流插件,旨在利用 Stable Diffusion、Cont···