Talker-T2AV 是数字人3D领域的开源项目,由 zhenye234 开发,是 2026 年新上线的项目。
它收录于数字人3D分类,该分类目前共有 272 个项目,GitHub 星标数为 87。
项目仍在小幅维护中,最近一次代码更新于 2026-09-15。Apache-2.0许可证,可自由使用和部署,无收费版本。
它主要面向的使用场景是:虚拟主播和数字人视频制作,快速生成口播内容。同类可对比的替代方案包括 SadTalker、Wav2Lip、GeneFace。

输入文本,一键生成音画同步的数字人说话视频
Talker-T2AV 是一个面向数字人视频生成的学术研究项目,发表于 ACM MM 2026,核心是联合生成与语音同步的音频和视频。它采用自回归扩散模型,将文本作为输入,直接生成说话人的面部视频和对应的语音,解决了传统方法中音频和视频分别生成再拼接导致的不同步、表情僵硬等问题。项目提供完整的训练和推理代码,支持自定义数据集,并包含预训练模型。其核心能力在于通过统一的生成框架,实现音频和视频的联合建模,从而提升口型同步精度和表情自然度,为虚拟主播、视频翻译、辅助沟通等应用提供技术基础。
SadTalker、Wav2Lip、GeneFace
Talker-T2AV 是数字人3D领域的开源项目,由 zhenye234 开发,是 2026 年新上线的项目。
它收录于数字人3D分类,该分类目前共有 272 个项目,GitHub 星标数为 87。
项目仍在小幅维护中,最近一次代码更新于 2026-09-15。Apache-2.0许可证,可自由使用和部署,无收费版本。
它主要面向的使用场景是:虚拟主播和数字人视频制作,快速生成口播内容。同类可对比的替代方案包括 SadTalker、Wav2Lip、GeneFace。
上一篇:utsuwa
下一篇:XnneHangLab
A3D
开源
在 three.js 里直接调用 AI 生成纹理和素材,边建模边生成
3D x AI hybrid editor, built with three.js
cube
开源
用一句话生成 3D 模型,在 Roblox 里快速落地 AI 创作
Roblox Foundation Model for 3D Intelligence
AG3D
开源
用2D图片直接生成3D虚拟人,告别昂贵扫描
Official code release for ICCV2023 paper AG3D: Learning to Generate 3D Avatars from ···
GameFactory-3A
开源
一条命令生成 3A 游戏资产,从模型到视频全自动
A comprehensive open-source 3A game-generation skill and asset framework.