Talking-Head
开源
稿子丢进去几分钟,数字人替你开口演讲。
AI 数字人口播工具:仅需一段文本或音频文件,几分钟内即可生成演讲视频,支持 100+ 种语言与 350+···
汇聚全球AI数字人与3D生成项目,虚拟主播、数字分身、3D建模工具大全。
共收录 273 个开源项目
Talking-Head
开源
稿子丢进去几分钟,数字人替你开口演讲。
AI 数字人口播工具:仅需一段文本或音频文件,几分钟内即可生成演讲视频,支持 100+ 种语言与 350+···
懒得录口播?一句话让数字人替你出镜。
AI 数字人视频生成工具:输入纯文本或音频文件,几分钟内即可生成口播视频,支持 100+ 种语言与 35···
几分钟生成一个主播,24 小时替你出镜带货。
AI 数字人主播生成器:输入文本或音频,几分钟内即可产出主播视频,支持 100+ 种语言与 350+ 音色模···
SGAM_NeurIPS22
开源
一张图生成连贯3D世界,生成与映射同步搞定
SGAM是NeurIPS 2022收录的3D场景生成与映射同步进行的研究项目。它旨在解决传统3D场景生成中生成与···
Mediapipe4u-plugin
开源
用摄像头实时驱动UE虚拟角色,动捕交互一步到位
Mediapipe4u-plugin 是一个将 Google MediaPipe 的实时人体追踪能力(面部、手势、姿态、整体动作)···
UE5-Dream
开源
在UE5里本地跑Stable Diffusion,边做边生成图像
UE5-Dream 是一个将 Stable Diffusion 图像生成能力集成到虚幻引擎 5(UE5)中的本地插件项目。它解···
stable-dreamfusion
开源
一句话生成 3D 模型,从文本或图片到可导出网格
stable-dreamfusion 是一个基于 NeRF 与扩散模型的开源 3D 生成工具,支持文本生成 3D、图像生成 3···
SolidUI
开源
一句话生成可视化图表,告别手写代码
SolidUI 是一个基于 AIGC 的图形生成框架,用户只需输入一句自然语言描述,即可自动生成对应的 2D ···
MotionDiffuse
开源
输入一句话,AI自动生成逼真的3D人体动画
MotionDiffuse 是一个基于扩散模型的文本驱动人体运动生成框架,旨在解决从自然语言描述直接生成高···
llm-metahuman
开源
用大模型驱动照片级逼真数字人,快速搭建沉浸式交互应用
llm-metahuman 是一个开源解决方案,旨在构建由 AI 驱动的照片级逼真数字人。它解决了传统数字人开···
ml-talking-face
开源
传一张照片和一段语音,自动生成对口型说话视频
这是一个基于CVPR 2022论文的AI数字人说话视频生成项目,通过输入一段音频和一张静态人脸照片,即可···
MM2022-ViCoPerceptualHeadGeneration
开源
用一张照片和驱动信号,生成口型同步的逼真说话人视频
ViCo 是一个面向对话场景的感知头部生成开源项目,来自 ACM MM 2022 Workshop。它解决的是在给定单···
SingleShapeGen
开源
一个 3D 模型,自动生成一堆相似新形状
SingleShapeGen 是 SIGGRAPH Asia 2022 论文《Learning to Generate 3D Shapes from a Single Exam···
输入一句话,自动生成并驱动3D虚拟人
AvatarCLIP 是 SIGGRAPH 2022 的论文项目,实现零样本文本驱动的 3D 虚拟人生成与动画。它解决了传···
LIHQ
开源
输入文字和形象,一键生成口型同步的高质量数字人演讲视频
LIHQ 是一个用于生成高质量 AI 虚拟主播/数字人视频的开源项目,核心目标是实现长文本推理下的高质···
sem2nerf
开源
一张语义图,直接生成可多视角观看的三维场景
Sem2NeRF 是 ECCV 2022 收录的研究项目,旨在将单张语义分割掩码(Semantic Mask)转换为三维神经辐···
CVPR2022-DaGAN
开源
用深度信息让说话头视频生成更逼真、姿态更可控
DaGAN 是 CVPR 2022 收录的论文《Depth-Aware Generative Adversarial Network for Talking Head V···
DigiHuman
开源
用普通摄像头就能驱动3D角色,告别昂贵动捕设备
DigiHuman 是一个基于 C# 的 3D 角色自动动画框架,利用姿态估计和地标生成技术,将单目摄像头或视···
awesome-talking-head-generation
开源
一张图看遍数字人技术,快速找到适合你的开源方案
这是一个汇集了数字人/说话头生成领域最前沿技术与资源的精选列表,旨在解决该领域资料分散、入门门···
wav2lip_288x288
开源
更高清唇形同步,让数字人说话更逼真
Wav2Lip 288x288 是一个基于 Wav2Lip 的改进版本,专注于高分辨率(288x288)的唇形同步视频生成。···
Audio2Head
开源
输入一张照片和语音,生成头部自然晃动的说话视频
Audio2Head 是一个基于 IJCAI 2021 论文的音频驱动说话头生成项目,专注于实现一次性(one-shot)的···
Blend_My_NFTs
开源
用 Blender 批量生成数千个 3D 变体,一键搞定 NFT 系列
Blend_My_NFTs 是一个基于 Blender 的自动化 3D 内容生成工具,主要面向 NFT 创作者和 3D 设计师。···
Co-Speech-Motion-Generation
开源
输入语音,自动生成数字人全身动作,省去动捕和手K动画。
Co-Speech-Motion-Generation 是一个从语音生成自由人体动作的开源项目,主要面向数字人、虚拟角色···
awesome-digital-human
开源
一份清单,搞定数字人从建模到动画的全技术栈选型。
这是一个精选数字人相关资源的开源项目,汇集了2D/3D/4D人体建模、虚拟化身生成与动画、穿衣人体数···