
Crystal.TTVS
让语音合成拥有3D表情,实时生成会说话的数字人
Crystal.TTVS 是一个基于 C++ 的实时多语言语音合成引擎,核心特点是配备 3D 表情化虚拟形象,实现音视频同步输出。它解决的是传统语音合成缺乏视觉表现力的问题,将文本到语音(TTS)与 3D 数字人渲染结合,生成具有口型同步和面部表情的虚拟说话人。引擎支持多语言,适合构建交互式数字人、虚拟助手、游戏角色等场景。其核心能力包括实时音频合成、3D 面部动画驱动、多语言支持,以及可扩展的架构,便于集成到不同应用中。项目处于早期阶段,代码结构清晰,但文档和示例相对有限。
开源
free
数字人3D
GitHub 星标
★ 88
维护状态
低维护
是否开源
是
定价模式
free
项目数据
分类数字人3D
开发团队thuhcsi
所属国家
定价模式free
价格说明开源项目,Apache-2.0许可证,可免费使用和部署。
访问状态
是否开源是
开源协议Apache-2.0
主要语言C++
技术栈/模型
GitHub 星标★ 88
30天Star增速
HF 下载量
上线时间2020-08-17 00:00:00
最近更新2026-06-03 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数0
核心亮点
- 音视频同步:内置口型同步和表情驱动,生成自然说话效果
- 多语言支持:面向多语言场景设计,扩展性强
- C++高性能:实时处理能力强,适合嵌入式或桌面应用
不足之处
- 文档/社区待观察
- 示例和教程较少,上手门槛较高
适用场景
- 数字人客服/导览
- 游戏NPC对话
- 辅助教学/语言学习
替代项目
Rhubarb Lip Sync、Live2D Cubism、TalkingHead
项目介绍
上一篇:Co-Speech-Motion-Generation
下一篇:WeClone
同类项目推荐
Open-LLM-VTuber
开源
对着电脑说话,Live2D 角色替你回答,支持打断,全本地运行。
Talk to any LLM with hands-free voice interaction, voice interruption, and Live2D ta···
JoyVASA
开源
上传一张图,让照片和动物动起来说话
Diffusion-based Portrait and Animal Animation
arbor
开源
用显式几何精确控制3D生成,告别随机形状
Control 3D Generation with Explicit Geometry
TripoSF
开源
从稀疏输入生成高分辨率、任意拓扑的 3D 模型
SparseFlex: High-Resolution and Arbitrary-Topology 3D Shape Modeling