ml-talking-face 是数字人3D领域的开源项目,由 deepkyu 开发,2022 年首次发布。
它收录于数字人3D分类,该分类目前共有 272 个项目,GitHub 星标数为 54。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-04-16。无在线服务,需自行部署,全部功能免费。
它主要面向的使用场景是:虚拟主播快速生成。同类可对比的替代方案包括 Wav2Lip、SadTalker、MakeItTalk。

传一张照片和一段语音,自动生成对口型说话视频
这是一个基于CVPR 2022论文的AI数字人说话视频生成项目,通过输入一段音频和一张静态人脸照片,即可生成人物嘴巴与音频同步的说话视频。项目核心解决的是数字人视频制作中口型同步的难题,利用深度学习模型分析音频特征并驱动面部关键点运动,实现自然逼真的口型匹配。作为Hugging Face Spaces的克隆仓库,它提供了完整的模型推理代码和预训练权重,开发者可以快速部署到本地或服务器,用于创建虚拟主播、教育视频、多语言配音等内容。项目采用Python实现,依赖主流的深度学习框架,适合研究语音驱动面部动画的技术人员或需要批量生成数字人视频的开发者。
Wav2Lip、SadTalker、MakeItTalk
ml-talking-face 是数字人3D领域的开源项目,由 deepkyu 开发,2022 年首次发布。
它收录于数字人3D分类,该分类目前共有 272 个项目,GitHub 星标数为 54。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-04-16。无在线服务,需自行部署,全部功能免费。
它主要面向的使用场景是:虚拟主播快速生成。同类可对比的替代方案包括 Wav2Lip、SadTalker、MakeItTalk。
上一篇:vtbai
A3D
开源
在 three.js 里直接调用 AI 生成纹理和素材,边建模边生成
3D x AI hybrid editor, built with three.js
cube
开源
用一句话生成 3D 模型,在 Roblox 里快速落地 AI 创作
Roblox Foundation Model for 3D Intelligence
AG3D
开源
用2D图片直接生成3D虚拟人,告别昂贵扫描
Official code release for ICCV2023 paper AG3D: Learning to Generate 3D Avatars from ···
GameFactory-3A
开源
一条命令生成 3A 游戏资产,从模型到视频全自动
A comprehensive open-source 3A game-generation skill and asset framework.