每日追踪数字人前沿论文,快速掌握最新技术动态
这是一个每日更新的数字人/虚拟化身论文列表,专注于2D说话头、3D头部化身和全身化身三大方向。项目···
汇聚全球AI数字人与3D生成项目,虚拟主播、数字分身、3D建模工具大全。
共收录 273 个开源项目
每日追踪数字人前沿论文,快速掌握最新技术动态
这是一个每日更新的数字人/虚拟化身论文列表,专注于2D说话头、3D头部化身和全身化身三大方向。项目···
WeClone
开源
用聊天记录一键训练你的 AI 分身,绑定机器人即可对话
WeClone 是一个一站式开源工具,旨在通过聊天记录微调大语言模型,打造个性化的 AI 分身。它解决了···
让网页里的虚拟形象开口说话,还能听懂你
这是一个基于浏览器运行的AI数字人对话项目,能够实现语音交互和实时口型同步。它通过OpenAI的GPT模···
dreamtalk
开源
一张照片加段语音,生成自然表情的说话视频
DreamTalk 是一个基于扩散概率模型的逼真说话人头生成项目,源自同名论文的官方实现。它解决的是从···
DiffusionGAN3D
开源
融合3D GAN与扩散先验,让文本快速生成高质量3D模型
DiffusionGAN3D 是一个 CVPR 2024 论文的开源实现,旨在结合 3D GAN 和扩散先验,提升文本引导的 3···
LLMUnity
开源
在 Unity 里拖拽几下,就能让 NPC 开口聊大模型。
LLMUnity 是一个让开发者能在 Unity 引擎中轻松集成大语言模型(LLM)的开源插件。它解决了游戏开发···
Bert-VITS2-ext
开源
让TTS角色开口说话时,表情和动作同步动起来
Bert-VITS2-ext 是一个基于 Bert-VITS2 的扩展项目,专注于为语音合成(TTS)添加表情和动画生成能···
Awesome-3D-AIGC
开源
一站式导航3D生成前沿,论文代码全收录
这是一个聚焦3D AIGC(人工智能生成内容)领域的精选资源列表,收录了相关论文和开源项目。它系统梳···
XnneHangLab
开源
给虚拟老婆装上耳朵和嘴巴,还能记住你们的事
XnneHangLab 是一个用 Python 构建的、面向二次元虚拟角色(waifus)的 AI 交互框架,旨在通过代码···
LiveTalking
开源
让数字人边听边说,口型跟得上,直播聊天不冷场
LiveTalking 是一个面向实时交互场景的开源数字人项目,主打流式生成和低延迟对话。它通过音频驱动···
Customize-it-3D
开源
单张照片,秒出高质量可编辑 3D 模型
Customize-It-3D 是 ICRA 2025 的官方实现,解决从单张图像生成高质量 3D 模型的难题。传统方法依赖···
Human101
开源
单视角视频,百秒训练,百帧渲染,快速生成可驱动3D数字人
Human101 是一个从单视角视频快速重建高保真 3D 数字人的开源项目,基于 3D Gaussian Splatting 技···
Holodeck
开源
输入一句话,自动生成 3D 室内环境,助力具身 AI 研究。
Holodeck 是一个基于 CVPR 2024 论文的开源项目,旨在通过自然语言指令自动生成 3D 具身 AI 环境。···
PrimDiffusion
开源
用扩散模型直接生成高质量3D人体,告别低效网格和点云
PrimDiffusion 是一个基于扩散模型的 3D 人体生成框架,核心创新在于使用体素化基元(Volumetric P···
Awesome-Talking-Head-Synthesis
开源
一库在手,语音驱动人脸合成资源全都有
Awesome-Talking-Head-Synthesis 是一个专注于语音驱动人脸合成(Talking Head Synthesis)领域的精···
En3D
开源
从 2D 合成图直接生成可动画的 3D 数字人
En3D 是 CVPR 2024 发表的论文官方实现,旨在从 2D 合成数据中生成高质量 3D 数字人。它解决传统 3···
GeoDream
开源
一句话文本/图片,生成多视角一致的高保真 3D 模型
GeoDream 是一个基于 Python 的 3D 生成项目,旨在从文本描述或单张图片生成高保真且多视角一致的 ···
Paint3D
开源
给 3D 模型一键生成无光照纹理,告别烘焙阴影
Paint3D 是一个面向 3D 模型的纹理生成工具,由 CVPR 2024 论文提出。它解决的核心问题是:传统 3D···
ShapeGPT
开源
用一句话生成3D模型,让设计触手可及
ShapeGPT 是一个将 3D 形状生成与多模态语言模型统一起来的开源项目。它旨在解决传统 3D 建模门槛高···
FaceTalk
开源
上传语音,一键生成3D数字人面部动画
FaceTalk 是一个基于音频驱动的 3D 数字人头像动画生成框架,来自 CVPR 2024。它利用扩散模型将语音···
momask-codes
开源
用掩码建模生成逼真3D动作,支持文本驱动
MoMask 是 CVPR 2024 的官方实现,用于 3D 人体动作生成。它提出了一种基于掩码建模的生成框架,将···
SyncTalk
开源
让数字人说话口型精准同步,告别嘴型对不上的尴尬
SyncTalk 是一个基于 CVPR 2024 论文的高保真数字人说话头合成项目,核心解决传统说话头生成中嘴唇···
MVControl
开源
用文本精准控制3D生成,几何细节更真实
MVControl是一个面向文本生成3D内容的开源项目,基于表面对齐的高斯泼溅技术,实现了可控的文本到3···
Open-LLM-VTuber
开源
对着电脑说话,Live2D 角色替你回答,支持打断,全本地运行。
Open-LLM-VTuber 是一个跨平台的开源语音交互助手,让你通过语音与任意大语言模型(LLM)对话,并配···