lip-sync
本站收录 18 个带「lip-sync」标签的 AI 开源项目
LiveTalkingLiveTalking 是一个面向实时交互场景的开源数字人项目,主打流式生成和低延迟对话。它通过音频驱动口型同步,结合 NeRF 三维重建与渲染技术,让虚拟形象★ 9,655
CyberVerseCyberVerse 是一个自托管的实时数字人智能体平台,旨在帮助开发者快速构建以语音交互为核心的 AI 代理。它解决了传统语音助手缺乏人格化形象和记忆能力的问★ 1,685
TalkingHeadTalkingHead 是一个基于 JavaScript 的实时口型同步类库,专门用于驱动全身 3D 虚拟形象说话。它解决了开发者快速为 3D 角色添加自然说话★ 1,572
sd-wav2lip-uhqsd-wav2lip-uhq 是一个为 Automatic1111 Stable Diffusion WebUI 开发的扩展,旨在将 Wav2Lip 唇形同步模★ 1,421
VideoChatVideoChat 是一个基于 Python 的实时交互数字人开源项目,旨在解决传统数字人开发门槛高、交互延迟大的问题。它允许用户自定义数字人的形象和音色,并支★ 1,313
wunjo.wladradchenko.ruWunjo CE 是一个本地运行的开源多媒体创作工具,集成了人脸替换、唇形同步、视频生成、物体/文字/背景移除、风格重绘、音频分离和声音克隆等多项 AI 能力。★ 1,171
JoyVASAJoyVASA 是一个基于扩散模型的数字人动画生成框架,专注于人像和动物肖像的动画化。它解决了传统动画生成中表情僵硬、动作不自然、跨物种适配困难等问题,核心能力★ 880
floatFLOAT 是一个基于 PyTorch 的音频驱动人像动画生成框架,论文发表于 ICCV 2025。它通过生成式运动潜流匹配(Generative Motion★ 492
AI-Video-Translation这是一个基于Google Colab的简易视频翻译工具,主要功能是将原始视频翻译成多种语言,并同步调整口型。它解决的是视频内容跨语言传播时,需要人工配音或字幕翻★ 254
HeadTTSHeadTTS 是一个基于 Kokoro 的免费神经文本转语音(TTS)工具,专为唇形同步(lip-sync)场景设计。它解决了传统 TTS 无法提供精确时间戳★ 178
vantavanta 是一个基于 Remotion 构建的开源 AI 视频引擎,旨在替代 Synthesia、HeyGen、Runway、CapCut 等商业工具。它解决★ 127
youtube-auto-dubyoutube-auto-dub 是一个本地优先的开源 YouTube 视频配音工具,旨在将视频中的原始语音克隆并翻译成另一种语言,同时保持时间同步。它解决了视★ 73
Talking-HeadAI 数字人口播工具:仅需一段文本或音频文件,几分钟内即可生成演讲视频,支持 100+ 种语言与 350+ 音色模型,大幅降低视频制作门槛。★ 38
ScrumSurvivor一个用照片级 AI 虚拟形象替你出镜的开源工具:在强制开摄像头的视频会议中「优雅幸存」。虚拟形象实时代替真人画面,适合对频繁视频会议感到疲惫、又想保持职业形象的★ 8
TA2.0音频驱动的数字人口型与视频生成方案:输入参考图片和语音音频,即可生成口型同步的说话头像视频,适合数字人克隆与视频内容生产。★ 5