HanaVerse
开源
让 Ollama 聊天变成和动漫少女面对面说话
HanaVerse 是一个基于 Web 的交互式聊天界面,专为 Ollama 设计,通过 Live2D 技术呈现一个生动的 ···
汇聚全球AI数字人与3D生成项目,虚拟主播、数字分身、3D建模工具大全。
共收录 273 个开源项目
HanaVerse
开源
让 Ollama 聊天变成和动漫少女面对面说话
HanaVerse 是一个基于 Web 的交互式聊天界面,专为 Ollama 设计,通过 Live2D 技术呈现一个生动的 ···
WorldGen
开源
输入一句话,几秒生成完整 3D 场景,无需建模基础。
WorldGen 是一个基于 Python 的 3D 场景生成工具,能在几秒钟内从文本描述或简单输入生成任意 3D 场···
awesome-ai-vtubers
开源
逛一圈,找到你想要的AI虚拟主播项目
这是一个精选AI虚拟主播(VTuber)及其相关项目的资源列表,旨在为对AI驱动的虚拟主播感兴趣的开发···
VideoScene
开源
输入图像,一步生成 3D 场景,告别多步优化
VideoScene 是一个 CVPR 2025 Highlight 项目,旨在将视频扩散模型的知识蒸馏到前馈网络,实现一步···
fantasy-talking
开源
让虚拟人说话更自然,动作表情不僵硬
FantasyTalking 是一个面向数字人领域的 3D 说话人像生成框架,由 ACM MM 2025 收录。它解决的是传···
omnitalker
开源
输入文本和参考视频,实时生成风格一致的数字人说话视频
OmniTalker 是一个基于 NeurIPS 2025 论文实现的实时文本驱动说话头生成项目,采用 JavaScript 技术···
handcrafted-persona-engine
开源
用 Live2D 和 AI 打造会说话、能变声的虚拟形象,快速开播。
这是一个基于 C# 的 AI 交互式虚拟形象引擎,整合了 Live2D 模型、大语言模型(LLM)、自动语音识别···
InterAct
开源
一句话生成3D人机交互动作,数据规模大、交互丰富
InterAct 是 CVPR 2025 收录的开源项目,专注于大规模、多样化的 3D 人体-物体交互(HOI)生成。它···
TripoSF
开源
从稀疏输入生成高分辨率、任意拓扑的 3D 模型
TripoSF 是一个基于 SparseFlex 方法的 3D 形状建模开源项目,专注于高分辨率与任意拓扑结构的 3D ···
HunyuanPortraitLCM
开源
一张照片+驱动视频,快速生成自然说话头像
HunyuanPortraitLCM 是腾讯混元团队开源的肖像动画生成框架,对应 CVPR 2025 论文。它解决传统肖像···
TripoSG
开源
输入图片或文字,秒级生成高保真 3D 模型
TripoSG 是一个基于大规模修正流模型的高保真 3D 形状生成开源项目,由 Tripo AI 团队开发。它解决···
ACTalker
开源
一句话生成逼真数字人视频,音频表情随心控
ACTalker 是一个基于视频扩散模型的端到端说话头生成框架,由 ICCV 2025 论文提出。它解决的是传统···
dso
开源
让AI生成的3D模型不再悬空塌陷,物理更真实
DSO是一个面向3D生成模型的物理合理性对齐框架,来自ICCV 2025。它针对当前3D生成模型(如文本到3D···
A3D
开源
在 three.js 里直接调用 AI 生成纹理和素材,边建模边生成
A3D 是一个基于 three.js 构建的 3D 与 AI 混合编辑器,旨在将传统 3D 建模流程与生成式 AI 能力无···
cube
开源
用一句话生成 3D 模型,在 Roblox 里快速落地 AI 创作
Cube 是一个面向 3D 智能的 Roblox 基础模型,旨在让开发者通过自然语言或简单输入直接生成、编辑和···
MIDI-3D
开源
单张照片,一键生成多物体 3D 场景
MIDI-3D 是一个基于扩散模型的单图生成 3D 场景的开源项目,由 CVPR 2025 收录。它解决的是从单张 ···
aafactory-prototype
开源
一键生成并管理你的 AI 虚拟形象
AI Avatar Factory 是一个用于创建和管理 AI 虚拟形象(Avatar)的早期原型项目,基于 Python 构建···
Hunyuan3D-2-WinPortable
开源
Windows上双击即用的腾讯混元3D生成工具
Hunyuan3D-2-WinPortable 是腾讯混元3D 2.0/2.1模型的Windows便携整合包,旨在解决官方模型在Windo···
Hunyuan3D-2
开源
一句话或一张图,秒级生成高精 3D 模型,无需专业建模技能。
Hunyuan3D-2 是腾讯开源的高分辨率 3D 资产生成模型,基于大规模扩散模型架构,能够从单张图片或文···
ditto-talkinghead
开源
音频驱动实时说话头像,运动空间扩散精准可控
Ditto 是一个面向实时可控说话人头像合成的运动空间扩散模型,发表于 ACM MM 2025。它解决的是传统···
CityDreamer4D
开源
从单图生成无限动态 4D 城市,用于仿真与创作
CityDreamer4D 是论文《Compositional Generative Model of Unbounded 4D Cities》的官方实现,发表···
Kiss3DGen
开源
用图像扩散模型直接生成3D资产,告别昂贵3D数据
Kiss3DGen 是一个基于 CVPR 2025 论文的官方实现,旨在复用图像扩散模型来生成 3D 资产。它解决了传···
断网也能克隆数字人,视频自己生成不花云钱。
真正开源的 AI 数字人工具包,支持离线视频生成与数字人克隆,让开发者无需依赖云端即可打造专属数···
AR123
开源
单图输入,自动生成多视角一致的3D模型
AR123 是 ICCV 2025 论文《AR-1-to-3: Single Image to Consistent 3D Object Generation via Next···