TA2.0

一张照片一段声音,让照片开口对台词。

音频驱动的数字人口型与视频生成方案:输入参考图片和语音音频,即可生成口型同步的说话头像视频,适合数字人克隆与视频内容生产。

开源 开源免费 数字人3D
GitHub 星标 ★ 4
维护状态 活跃
是否开源
定价模式 开源免费

项目数据

分类数字人3D
开发团队neosapience
所属国家
定价模式开源免费
价格区间
是否开源
开源协议Apache-2.0
主要语言Python
技术栈/模型ai-avatar,audio-driven-animation,avatar-animation,computer-vision,digital-human,generative-ai,huggingface,image-to-video,lip-sync,multimodal,pytorch,talking-avatar,video-generation
GitHub 星标★ 4
30天Star增速
HF 下载量
上线时间2026-08-03 00:00:00
最近更新2026-08-07 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数0

核心亮点

    不足之处

      适用场景

        替代项目

        项目介绍

        音频驱动的数字人口型与视频生成方案:输入参考图片和语音音频,即可生成口型同步的说话头像视频,适合数字人克隆与视频内容生产。。主要使用 Python 开发,GitHub 星标 4。

        上一篇:heygen-app

        下一篇:DLRS

        同类项目推荐

        AniGen 开源

        [SIGGRAPH 2026] AniGen: Unified S^3 Fields for Animatable 3D Asset Generation

        ★ 476 2026-08-09
        Open-LLM-VTuber 开源

        Talk to any LLM with hands-free voice interaction, voice interruption, and Live2D ta···

        ★ 13154 2026-08-09
        AR123 开源

        Official Code for 'AR-1-to-3: Single Image to Consistent 3D Object Generation via Ne···

        ★ 64 2026-08-09