Crystal.TTVS

让语音合成拥有3D表情,实时生成会说话的数字人

Crystal.TTVS 是一个基于 C++ 的实时多语言语音合成引擎,核心特点是配备 3D 表情化虚拟形象,实现音视频同步输出。它解决的是传统语音合成缺乏视觉表现力的问题,将文本到语音(TTS)与 3D 数字人渲染结合,生成具有口型同步和面部表情的虚拟说话人。引擎支持多语言,适合构建交互式数字人、虚拟助手、游戏角色等场景。其核心能力包括实时音频合成、3D 面部动画驱动、多语言支持,以及可扩展的架构,便于集成到不同应用中。项目处于早期阶段,代码结构清晰,但文档和示例相对有限。

开源 free 数字人3D
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 88
维护状态 低维护
是否开源
定价模式 free

项目数据

分类数字人3D
开发团队thuhcsi
所属国家
官网地址
定价模式free
价格说明开源项目,Apache-2.0许可证,可免费使用和部署。
访问状态
是否开源
开源协议Apache-2.0
主要语言C++
技术栈/模型
GitHub 星标★ 88
30天Star增速
HF 下载量
上线时间2020-08-17 00:00:00
最近更新2026-06-03 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数0

核心亮点

  • 音视频同步:内置口型同步和表情驱动,生成自然说话效果
  • 多语言支持:面向多语言场景设计,扩展性强
  • C++高性能:实时处理能力强,适合嵌入式或桌面应用

不足之处

  • 文档/社区待观察
  • 示例和教程较少,上手门槛较高

适用场景

  • 数字人客服/导览
  • 游戏NPC对话
  • 辅助教学/语言学习

替代项目

Rhubarb Lip Sync、Live2D Cubism、TalkingHead

项目介绍

Crystal.TTVS 是一个数字人3D领域的开源项目,官方简介:Crystal TTVS engine is a real-time audio-visual Multilingual speech synthesizer with a 3D expressive avatar.。项目使用 C++ 开发,在 GitHub 上获得 88 星标。

上一篇:Co-Speech-Motion-Generation

下一篇:WeClone

同类项目推荐

Open-LLM-VTuber 开源

对着电脑说话,Live2D 角色替你回答,支持打断,全本地运行。

Talk to any LLM with hands-free voice interaction, voice interruption, and Live2D ta···

★ 13347 2026-08-09
JoyVASA 开源

上传一张图,让照片和动物动起来说话

Diffusion-based Portrait and Animal Animation

★ 876 2026-08-09
arbor 开源

用显式几何精确控制3D生成,告别随机形状

Control 3D Generation with Explicit Geometry

★ 103 2026-08-09
TripoSF 开源

从稀疏输入生成高分辨率、任意拓扑的 3D 模型

SparseFlex: High-Resolution and Arbitrary-Topology 3D Shape Modeling

★ 759 2026-08-09