talk-to-fengge

克隆声音性格,1秒内实时对话

这是一个基于实时语音技术的声音与性格克隆项目,旨在让用户与任何人的数字分身进行自然对话。它解决了传统语音助手缺乏个性化和真实感的问题,通过克隆目标人物的音色和说话风格,并整合STT、TTS和实时通信技术,实现了工程延迟低于1秒的实时语音交互。项目核心能力包括声音克隆、性格模拟、低延迟通话以及可扩展的实时语音管道,支持中文环境,适合构建个性化语音助手、虚拟偶像互动或沉浸式角色扮演体验。

开源 unknown 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 467
维护状态 维护中
是否开源 是
定价模式 unknown

项目数据

分类音频音乐
开发团队YeJe-cpu
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议Apache-2.0
主要语言Python
技术栈/模型chinese-ai,fengge,livekit,persona-ai,real-time-voice,stt,tts,voice-cloning,voxcpm
GitHub 星标★ 467
30天Star增速
HF 下载量
上线时间2026-06-25 00:00:00
最近更新2026-09-23 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

核心亮点

  • 工程延迟低于1秒,对话流畅无卡顿
  • 支持声音与性格双重克隆,交互更具个性
  • 基于LiveKit等成熟技术栈,实时通信稳定

不足之处

  • 早期项目,文档和社区支持待观察
  • 声音克隆效果依赖输入样本质量,可能不稳定

适用场景

  • 个性化语音助手定制
  • 虚拟偶像或角色实时互动
  • 沉浸式语音聊天应用

替代项目

OpenVoice、ChatTTS、Coqui TTS

项目介绍

talk-to-fengge 是音频音乐领域的开源项目,由 YeJe-cpu 开发,是 2026 年新上线的项目。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 467。

项目仍在小幅维护中,最近一次代码更新于 2026-09-23。

它主要面向的使用场景是:个性化语音助手定制。同类可对比的替代方案包括 OpenVoice、ChatTTS、Coqui TTS。

上一篇:xttsv2-vllm-streaming-server

下一篇:jpreprocess

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 246 2026-08-09