ZerolanLiveRobot

让 AI 虚拟主播自动直播、陪你玩 MC,全栈 AI 驱动

ZerolanLiveRobot 是一个基于 Python 的 AI 虚拟主播(VTuber)开源项目,旨在通过集成大语言模型(LLM)、语音识别(ASR)、语音合成(TTS)、OCR、计算机视觉(CV)等多种 AI 技术,让虚拟形象能够与观众实时互动,进行直播或陪你玩《我的世界》。项目解决了传统虚拟主播需要真人驱动、互动性有限的问题,提供了一套自动化的 AI 驱动方案。其核心能力包括:基于 LLM 的对话生成、语音输入输出、画面内容识别(如识别游戏画面或弹幕图片)、以及视频/图像描述生成,从而实现对直播场景和游戏环境的感知与响应。项目早期阶段已具备基本框架,支持 B 站等平台,适合开发者二次开发定制自己的 AI 主播。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 805
维护状态 低维护
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队AkagawaTsurunaki
所属国家
定价模式free
价格说明开源项目,MIT许可证,完全免费,需自行部署。
访问状态
是否开源
开源协议MIT
主要语言Python
技术栈/模型ai,ai-vtuber,asr,bilibili,cv,image-captioning,llm,minecraft,ocr,tts,video-captioning
GitHub 星标★ 805
30天Star增速
HF 下载量
上线时间2024-03-04 00:00:00
最近更新2026-09-22 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 集成 LLM+ASR+TTS+OCR+CV 多模态能力,互动维度丰富
  • 支持 B 站直播和《我的世界》游戏场景,落地场景明确
  • Python 技术栈,模块化设计,便于二次开发扩展

不足之处

  • 早期项目,文档和社区生态待观察
  • 依赖多模型服务,部署配置复杂度较高

适用场景

  • B 站等平台 24 小时无人值守 AI 直播
  • AI 陪玩《我的世界》,实时语音交互
  • 直播弹幕智能回复与画面内容识别

替代项目

Live2D-VTuber、AI-Vtuber、TalkingHead

项目介绍

ZerolanLiveRobot 是数字人3D领域的开源项目,由 AkagawaTsurunaki 开发,2024 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(805)位列前 30%,在数字人3D分类中处于中上游。

近 45 天,它的 GitHub 星标从 778 增加到 805,净增 27。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。MIT许可证,完全免费,需自行部署。

它主要面向的使用场景是:B站等平台24小时无人值守AI直播。同类可对比的替代方案包括 Live2D-VTuber、AI-Vtuber、TalkingHead。

上一篇:AI-Waifu-Vtuber

下一篇:Mediapipe4u-plugin

同类项目推荐

A3D 开源

在 three.js 里直接调用 AI 生成纹理和素材,边建模边生成

3D x AI hybrid editor, built with three.js

★ 129 2026-08-09
cube 开源

用一句话生成 3D 模型,在 Roblox 里快速落地 AI 创作

Roblox Foundation Model for 3D Intelligence

★ 1254 2026-08-09
AG3D 开源

用2D图片直接生成3D虚拟人,告别昂贵扫描

Official code release for ICCV2023 paper AG3D: Learning to Generate 3D Avatars from ···

★ 273 2026-08-09
GameFactory-3A 开源

一条命令生成 3A 游戏资产,从模型到视频全自动

A comprehensive open-source 3A game-generation skill and asset framework.

★ 778 2026-08-21