xiaozhi-esp32-server-java

用Java轻松管理你的小智ESP32语音设备,实现音色定制与角色切换。

小智ESP32的Java企业级管理平台,为基于ESP32的智能语音设备提供一站式后端服务。它解决了小智AI设备在设备管理、音色定制、角色切换和对话记录管理方面的痛点,将前后端及服务端一体化。核心能力包括设备监控、灵活的TTS音色配置、多角色切换以及完整的对话日志管理。项目基于Spring AI构建,深度集成MCP(模型上下文协议)客户端与服务端,支持STT/TTS,为开发者提供了从设备接入到AI能力编排的完整闭环。通过Java技术栈,实现了企业级的高可用、可扩展架构,适合需要规模化部署和定制化管理的智能硬件场景。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1357
维护状态 活跃
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队joey-zhou
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,可免费使用和部署。
访问状态
是否开源
开源协议MIT
主要语言Java
技术栈/模型esp32,java,mcp,mcp-client,mcp-server,spring-ai,stt,tts,xiaozhi,xiaozhi-ai,xiaozhi-esp32,xiaozhi-server
GitHub 星标★ 1357
30天Star增速
HF 下载量
上线时间2025-02-27 00:00:00
最近更新2026-09-22 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

难度:进阶 约 15 分钟 部署方式:本地安装 6 步

环境要求

  • Linux(推荐 CentOS)或 Windows 操作系统,生产环境推荐 Linux
  • 已安装 Git,用于克隆仓库
  • 具备 Java 运行环境(具体版本参见 docs/CENTOS_DEVELOPMENT.md 或 docs/WINDOWS_DEVELOPMENT.md)
  • 能正常访问 GitHub 的网络,用于下载模型与原生库
  • 一台已烧录固件的 ESP32 智能硬件设备(用于接入验证)

安装与启动步骤

  1. 1克隆仓库

    从 GitHub 拉取项目源码到本地,注意仓库较大,网络不畅时可配置代理。

    git clone https://github.com/joey-zhou/xiaozhi-esp32-server-java
  2. 2进入项目目录

    切换到克隆下来的项目根目录,后续脚本命令都在此目录下执行。

    cd xiaozhi-esp32-server-java
  3. 3下载模型与原生库

    models/ 和 lib/ 不在 Git 仓库中,首次部署必须执行本脚本下载模型和原生库。

    ./scripts/download_models.sh
  4. 4下载基础资源(可选)

    若使用第三方 STT/TTS,可改跑该脚本,仅下载 VAD 模型和原生库,减少下载量。

    ./scripts/download_base.sh
  5. 5一键编译并启动

    脚本会自动编译并同时启动 server 与 dialogue 两个进程,首次编译耗时较长。

    bin/all.sh start
  6. 6查看运行状态

    确认两个进程是否正常运行,若未启动可查看日志排查。

    bin/all.sh status

如何确认成功

执行 bin/all.sh status 查看进程状态;启动成功后 xiaozhi-server 输出 OTA 地址、xiaozhi-dialogue 输出 WebSocket 连接地址。

常见问题

Q:为什么克隆后找不到 models/ 和 lib/ 目录?

A:这两个目录不在 Git 仓库中,首次部署必须执行 ./scripts/download_models.sh 下载模型和原生库后才能启动。

Q:只想用第三方 STT/TTS,可以少下载点东西吗?

A:可以。执行 ./scripts/download_base.sh,它只下载 VAD 模型和原生库,跳过完整模型下载。

Q:可以用 Docker 部署吗?

A:可以,项目提供 Docker 部署方式,具体步骤见仓库 docs/DOCKER.md 文档。

Q:Windows 上怎么部署?

A:README 提供了 Windows 部署文档,见 docs/WINDOWS_DEVELOPMENT.md,适合开发和测试场景。

Q:服务起来了,ESP32 设备怎么接入?

A:按 docs/FIRMWARE-BUILD.md 编译并烧录固件,然后让设备使用 xiaozhi-server 输出的 OTA 地址和 xiaozhi-dialogue 的 WebSocket 地址接入。

注意事项

  • models/ 和 lib/ 不随 Git 仓库分发,首次部署必须通过脚本下载,否则无法启动。
  • 项目为多模块 + 双进程架构,bin/all.sh 会同时管理 server 和 dialogue 两个进程。
  • 源码部署有 Linux(CentOS,推荐生产)与 Windows(开发测试)两套文档,Docker 与固件编译另有独立文档。
  • README 未给出具体 Java 版本、端口和配置项,实际参数请以 docs/ 目录下对应部署文档为准。

核心亮点

  • 提供设备监控、音色定制、角色切换和对话记录管理的一体化解决方案,功能全面。
  • 深度集成Spring AI和MCP,便于接入和编排多种AI模型与工具。
  • 前后端及服务端一体化,降低了部署和运维复杂度。

不足之处

  • 项目文档和社区生态尚待完善,新手上手可能有一定门槛。
  • 主要针对ESP32硬件,适用场景相对垂直。

适用场景

  • 智能音箱/语音助手的设备管理与个性化配置
  • 需要定制音色和角色的人机交互产品开发
  • 基于ESP32的语音设备规模化部署与运维

替代项目

xiaozhi-esp32-server (Python版)、Home Assistant、OpenVoice

项目介绍

xiaozhi-esp32-server-java 是智能体领域的开源项目,由 joey-zhou 开发,2025 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(1,357)位列前 30%,在智能体分类中处于中上游。

近 45 天,它的 GitHub 星标从 1,325 增加到 1,357,净增 32。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。MIT许可证,可免费使用和部署。

它主要面向的使用场景是:智能音箱/语音助手的设备管理与个性化配置。同类可对比的替代方案包括 xiaozhi-esp32-server (Python版)、Home Assistant、OpenVoice。

上一篇:cadis

下一篇:OpenGuider

同类项目推荐

xinchao-dynamic-mind 开源

给 AI 装上疲惫和欲望,让交互更真实

独立、可自托管的 AI 动态心智状态引擎:驱动力、念头池、疲惫、睡眠与意图。

★ 195 2026-08-09
deepseek-harness 开源

把 AI 能力拆成乐高积木,拼出你的专属智能体。

DeepSeek Harness: Everything is a Plugin.

★ 233327 2026-08-15
AutoGPT 开源

开箱即用的 AI 员工,交代任务就自己干完

AutoGPT is the vision of accessible AI for everyone, to use and to build on. Our mis···

★ 187492 2026-08-09
EvoAgentX 开源

让 AI 智能体自己迭代变强,越用越聪明

EvoAgentX: Building a Self-Evolving Ecosystem of AI Agents

★ 3351 2026-09-12