text-to-motion
本站收录 10 个带「text-to-motion」标签的 AI 开源项目
MotionGPTMotionGPT 是一个将人体运动视为一种‘外语’的统一生成模型,发表于 NeurIPS 2023。它利用大型语言模型(LLM)的架构来处理运动序列,将动作数★ 1,974
momask-codesMoMask 是 CVPR 2024 的官方实现,用于 3D 人体动作生成。它提出了一种基于掩码建模的生成框架,将动作序列离散化为量化码本,通过双向 Trans★ 1,320
MotionDirectorMotionDirector 是 ECCV 2024 Oral 论文的开源实现,专注于文本到视频扩散模型的运动定制。它解决的是现有视频生成模型难以精确控制动作、★ 1,055
motion-latent-diffusionmotion-latent-diffusion 是一个基于潜在空间运动扩散模型的开源项目,发表于 CVPR 2023。它旨在解决文本或动作指令到人体运动生成的任★ 747
Bert-VITS2-extBert-VITS2-ext 是一个基于 Bert-VITS2 的扩展项目,专注于为语音合成(TTS)添加表情和动画生成能力。它解决的是传统 TTS 仅输出音频★ 539
MotionGPT3MotionGPT3 是一个基于多模态大语言模型(MoT)框架的开源项目,旨在将人体运动作为第二种模态,与文本、语言模型统一处理,实现运动的理解与生成。它解决的★ 242
InterActInterAct 是 CVPR 2025 收录的开源项目,专注于大规模、多样化的 3D 人体-物体交互(HOI)生成。它解决的是现有数据集规模小、交互类型单一、★ 209
FRoM-W1FRoM-W1 是一个面向通用人形机器人全身控制的开源模型,基于 arXiv 论文实现,旨在通过自然语言指令驱动机器人完成复杂的全身动作。它解决了人形机器人控制★ 194
HandXHandX 是一个面向双手(双人)运动与交互生成的开源项目,发表于 CVPR 2026。它解决的是现有数字人模型仅能生成单人或单手动作、缺乏双手协调与物体交互能★ 143
LIGHTLIGHT 是一个面向数字人3D动画的开源项目,专注于人体-物体交互(HOI)动画生成。它提出了一种无需分类器引导的新方法,在ICLR 2026论文中发布。该项★ 59