NeRFFaceSpeech_Code 是数字人3D领域的开源项目,由 rlgnswk 开发,2024 年首次发布。
它收录于数字人3D分类,该分类目前共有 272 个项目,GitHub 星标数为 65。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-06-28。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:数字人直播或视频制作,用单张照片快速生成虚拟主播。同类可对比的替代方案包括 SadTalker、Wav2Lip、ER-NeRF。

单张照片+语音,生成逼真3D说话头像
NeRFFaceSpeech_Code 是一个基于 NeRF(神经辐射场)的 3D 说话头生成开源项目,对应 CVPRW 2024 论文。它解决的是从单张人脸图片和一段音频驱动生成逼真 3D 说话头的问题,即 one-shot 音频驱动的 3D 说话头合成。核心能力包括:利用生成先验(如 3D GAN)来增强 NeRF 的泛化能力,在仅有单张参考图的情况下,也能生成具有自然唇形、表情和头部姿态的 3D 动态头像。项目提供完整的训练和推理代码,支持自定义音频和图片输入,输出视频或 3D 模型。技术栈以 Python 和 PyTorch 为主,适合研究数字人、虚拟形象生成、人机交互等领域。当前项目处于早期阶段,代码结构清晰,但依赖较多,需要一定的环境配置。
SadTalker、Wav2Lip、ER-NeRF
NeRFFaceSpeech_Code 是数字人3D领域的开源项目,由 rlgnswk 开发,2024 年首次发布。
它收录于数字人3D分类,该分类目前共有 272 个项目,GitHub 星标数为 65。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-06-28。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:数字人直播或视频制作,用单张照片快速生成虚拟主播。同类可对比的替代方案包括 SadTalker、Wav2Lip、ER-NeRF。
上一篇:DiffPoseTalk
下一篇:SadTalker
A3D
开源
在 three.js 里直接调用 AI 生成纹理和素材,边建模边生成
3D x AI hybrid editor, built with three.js
cube
开源
用一句话生成 3D 模型,在 Roblox 里快速落地 AI 创作
Roblox Foundation Model for 3D Intelligence
AG3D
开源
用2D图片直接生成3D虚拟人,告别昂贵扫描
Official code release for ICCV2023 paper AG3D: Learning to Generate 3D Avatars from ···
GameFactory-3A
开源
一条命令生成 3A 游戏资产,从模型到视频全自动
A comprehensive open-source 3A game-generation skill and asset framework.