Text2Video
开源
输入文字,自动生成口型同步的说话人视频。
Text2Video 是一个基于 ICASSP 2022 论文的开源项目,实现文本驱动的说话人视频合成。它通过音素字···
汇聚全球AI数字人与3D生成项目,虚拟主播、数字分身、3D建模工具大全。
共收录 273 个开源项目
Text2Video
开源
输入文字,自动生成口型同步的说话人视频。
Text2Video 是一个基于 ICASSP 2022 论文的开源项目,实现文本驱动的说话人视频合成。它通过音素字···
latent-pose-reenactment
开源
用一张照片驱动任意头部视频,生成逼真数字人动画
这是CVPR 2020论文《Neural Head Reenactment with Latent Pose Descriptors》的官方实现,用于数字···
Crystal.TTVS
开源
让语音合成拥有3D表情,实时生成会说话的数字人
Crystal.TTVS 是一个基于 C++ 的实时多语言语音合成引擎,核心特点是配备 3D 表情化虚拟形象,实现···
Speech2Video
开源
输入一段语音,自动生成带3D姿态的说话人视频
Speech2Video 是一个基于 ACCV 2020 论文的开源项目,旨在从单一音频输入生成具有3D骨架正则化和丰···
ChatdollKit
开源
让 3D 模型秒变能听会说的 AI 聊天角色
ChatdollKit 是一个基于 Unity 的开源框架,旨在将 3D 模型(如 VRM 模型)快速转化为具备语音交互···
location-based-AR-app
开源
用 Flutter 快速搭建带语音导航的 AR 定位应用
这是一个基于 Flutter 的示例应用,演示如何构建带有导航功能的定位增强现实(AR)应用。它利用 AR···
icface
开源
用动作单元精准控制人脸表情,让静态照片动起来
ICface 是一个基于 GAN 的人脸重演(Face Reenactment)开源项目,旨在实现可解释且可控的人脸动画···
NOC3D-chapter6
开源
把《代码本色》的智能体算法搬进 3D 世界,边看边学
NOC3D-chapter6 是《Nature of Code》书中“自主智能体”章节的 3D 实现示例集,使用 JavaScript 和···
resonate
开源
用代码生成沉浸式 VR 世界,探索无限虚拟空间
Resonate 是一个正在构建生成式 VR 世界的开源项目,目前处于早期阶段。它旨在利用生成算法,让用户···