digital-human

本站收录 40 个带「digital-human」标签的 AI 开源项目

colleague-skillcolleague-skill 是一个将离职同事的知识与经验转化为可复用 AI 技能(Skill)的开源项目,旨在把冰冷的告别变成温暖的数字遗产。它通过知识蒸馏★ 25,130distillyDistilly 是一个将 AI 智能体的思考过程提炼为可复用技能(Skills)的开源工具,前身为 Colleague Skill。它解决了 AI 智能体在特★ 25,130Duix-Avatar真正开源的 AI 数字人工具包,支持离线视频生成与数字人克隆,让开发者无需依赖云端即可打造专属数字分身,是数字人领域的高人气开源方案。★ 15,608LiveTalkingLiveTalking 是一个面向实时交互场景的开源数字人项目,主打流式生成和低延迟对话。它通过音频驱动口型同步,结合 NeRF 三维重建与渲染技术,让虚拟形象★ 9,655Duix-MobileDuix-Mobile 是一款面向移动端和边缘设备的实时交互式 AI 数字人(3D 虚拟形象)解决方案,主打本地化部署和超低延迟(<1.5 秒)。它解决了传统数★ 8,258Streamer-SalesStreamer-Sales 是一个开源的卖货主播大模型,旨在根据商品特点自动生成激发用户购买意愿的解说内容。它解决了电商直播中内容创作成本高、个性化不足的问题★ 3,777N.E.K.ON.E.K.O 是一个开源的实时 AI 猫娘数字人项目,旨在打造一个主动交互、情感驱动的虚拟伴侣。它解决了传统 AI 助手被动响应、缺乏情感连接的问题,通过内置★ 2,990ProtoMotionsProtoMotions 是一个基于 GPU 加速的物理仿真与强化学习框架,专为训练物理模拟的数字人和人形机器人而设计。它解决了传统物理仿真速度慢、难以扩展到复★ 2,409awesome-digital-human这是一个精选数字人相关资源的开源项目,汇集了2D/3D/4D人体建模、虚拟化身生成与动画、穿衣人体数字化、虚拟试穿等领域的论文、代码和工具。它解决了数字人领域资★ 1,982lanshu-create-ai-presenter-video这是一个基于 Codex Skill 的数字人视频生成工具,核心功能是从用户提供的脚本和授权的主持人图片,自动生成经过验证的 AI 主持人视频。它采用提供商中立★ 1,847CyberVerseCyberVerse 是一个自托管的实时数字人智能体平台,旨在帮助开发者快速构建以语音交互为核心的 AI 代理。它解决了传统语音助手缺乏人格化形象和记忆能力的问★ 1,685GNMGNM 是一个开源的参数化人体模型与感知栈生态系统,当前以 GNM Head 为起点,提供高精度的头部参数化模型。它解决了数字人领域缺乏统一、可扩展的模型标准问★ 1,538VideoChatVideoChat 是一个基于 Python 的实时交互数字人开源项目,旨在解决传统数字人开发门槛高、交互延迟大的问题。它允许用户自定义数字人的形象和音色,并支★ 1,313SOMA-XSOMA-X是一个统一参数化人体模型的Python开源库,旨在解决现有3D人体模型(如SMPL、SMPL-X、MANO等)格式不统一、难以互操作的问题。它提供了★ 797DigiHumanDigiHuman 是一个基于 C# 的 3D 角色自动动画框架,利用姿态估计和地标生成技术,将单目摄像头或视频中的人体动作实时映射到 3D 模型上。它解决了传★ 588ai-avatar-system开箱即用的 AI 数字人平台,上传一张照片、克隆一段声音,即可通过唇形同步视频与任意面孔实时对话。完全开源、支持自托管,基于 Claude、Whisper、Ch★ 511talking-avatar-with-ai这是一个基于浏览器运行的AI数字人对话项目,能够实现语音交互和实时口型同步。它通过OpenAI的GPT模型生成对话内容,Whisper进行语音识别,Eleven★ 467GLAMRGLAMR是CVPR 2022 Oral论文的官方PyTorch实现,专注于动态相机下的全局遮挡感知人体网格恢复。它解决的是在复杂动态场景中,当人体被部分遮挡或★ 390dlp3d.aidlp3d.ai 是一个开源的自主3D角色项目,旨在让开发者能够在网页上创建和部署具有自主行为的3D数字人。它解决了传统3D角色开发中需要复杂建模、动画和AI集★ 364SIFUSIFU是CVPR 2024 Highlight论文的官方实现,专注于从单张RGB图像重建穿着衣服的3D人体模型。它解决的是真实世界场景下,传统方法因遮挡、复杂★ 275IMAI.WORK-AI-PhoneIMAI.WORK-AI-Phone 是一个基于安卓手机的开源 AI 自动化营销工具,定位为“手机版 OpenClaw”,通过无障碍模式实现端到端远控和 RPA★ 231three.wsthree.ws 是一个开源的 3D AI 智能体框架,基于 Three.js 构建,支持加载 GLB/glTF 格式的 3D 角色模型,并为这些角色赋予大语言★ 217AIAvatar帮你构建个人专属 AI 数字人,实现音视频同步的实时交互对话。开源实现,支持数字分身定制,适合搭建自己的虚拟形象助手。★ 197instant-nvrinstant-nvr 是 CVPR 2023 的官方代码实现,专注于在几分钟内学习动态人体的神经体积表示。它解决了传统动态人体重建方法训练时间长、计算资源消耗★ 162llm-metahumanllm-metahuman 是一个开源解决方案,旨在构建由 AI 驱动的照片级逼真数字人。它解决了传统数字人开发中需要整合多种复杂技术(如大语言模型、语音合成、★ 146Partlawyer-LAAPartlawyer-LAA 是一个基于数字人技术和微调大模型的劳动仲裁辅助平台。它主要面向劳动者和律师,解决劳动仲裁过程中文书撰写难、法律咨询门槛高的问题。平★ 144ASHASH 是 CVPR 2024 论文《Ash: Animatable Gaussian Splats for Efficient and Photoreal H★ 137dsh-voice-ai-girlfriend这是一个面向 DeepSeek Harness(DSH)的语音 AI 女友插件,用 TypeScript 编写。它把语音识别、语音合成和数字人动画串成一条完整的★ 129OakInk2OakInk2 是一个用于双手-物体操作研究的3D数据集,由 CVPR 2024 发布。它记录了人类在复杂任务完成过程中的双手和物体交互,包含精细的3D手部网格★ 112Human101Human101 是一个从单视角视频快速重建高保真 3D 数字人的开源项目,基于 3D Gaussian Splatting 技术,能在 100 秒内完成训练,★ 110qietiao_ai茄条AI是一个基于TypeScript开发的数字人短视频智能体项目,旨在通过自动化流水线解决短视频创作中内容生产、数字人播报和多平台分发效率低下的问题。它集成了★ 77HanaVerseHanaVerse 是一个基于 Web 的交互式聊天界面,专为 Ollama 设计,通过 Live2D 技术呈现一个生动的 2D 动漫角色 Hana。它解决了传★ 72STARSTAR 是一个基于文本描述生成 4D 数字人(含骨骼动画)的开源项目,核心解决“文字直接驱动 3D 角色动画”的难题。它提出骨骼感知的文本到 4D 化身生成框★ 65awesome-avatar这是一个聚焦于数字人/虚拟形象(Avatar)领域的精选资源列表,主要面向3D数字人技术。项目以Jupyter Notebook形式组织,收集了与头像生成、动画★ 61ArtEqArtEq 是一个基于神经网络的 3D 人体姿态拟合工具,核心创新在于利用 articulated SE(3) 等变性,将训练时见过的姿态泛化到未见过的姿态。它★ 57GuidoGuido 是一个面向景区导览场景的 AI 数字人系统,基于 Spring Boot 后端、Vue 3 管理端和 UniApp 移动端构建,并集成本地 RAG ★ 54TA2.0音频驱动的数字人口型与视频生成方案:输入参考图片和语音音频,即可生成口型同步的说话头像视频,适合数字人克隆与视频内容生产。★ 5OliveWolf开源 3D 数字人引擎,采用 LHM(全身 3D)与 LivePortrait(2D 头肩)双后端,支持实时音频驱动的问答交互,具备企业级部署能力,由 Mira★ 5DLRS隐私优先的数字生命档案标准,聚焦同意治理、AI 数字人与数字遗产记录,为个人数字生命数据提供规范化、可治理的存储规范。★ 4LangQingSOTA 级实时交互 AI 数字人平台,支持多模态对话,提供流式的数字人交互体验,适合构建下一代实时对话数字人系统。★ 4