wukong-robot

用 Python 快速打造你的中文智能音箱,还能脑机控制

wukong-robot 是一个基于 Python 的中文语音对话机器人/智能音箱开源项目。它解决了从零搭建一个具备语音交互能力的智能音箱的复杂问题,提供了完整的语音唤醒、语音识别、语义理解和语音合成链路。项目核心能力包括:支持多种唤醒词(如“悟空”),可自定义;支持离线或在线语音识别(如讯飞、百度);内置多轮对话管理,并已集成 ChatGPT 实现更自然的对话;同时支持通过插件机制扩展技能,如控制智能家居、播放音乐、查询天气等。项目还探索了脑机交互,成为首个支持脑机接口的智能音箱,可通过脑电波设备控制。整体设计追求简单、灵活、优雅,适合开发者二次开发和硬件 DIY。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 7129
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队wzpan
所属国家
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型ai,alexa,amazon-echo,anyq,asr,bci,chatgpt,google-home,gpt3,homeassistant,muse,openai,raspeberry-pi,snowboy,speaker,tts,unit
GitHub 星标★ 7129
30天Star增速
HF 下载量
上线时间2019-01-16 00:00:00
最近更新2026-09-22 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

难度:进阶 约 30 分钟 部署方式:本地安装 6 步

环境要求

  • Python 3.7 或更高版本(README 徽章标注 Python>=3.7)
  • 需要获取 wukong-robot 项目源码(GitHub 仓库)
  • 建议准备 tmux 或 supervisor 作为常驻运行环境
  • 需要麦克风等音频输入设备用于语音唤醒与交互

安装与启动步骤

  1. 1获取项目代码

    从 GitHub 克隆仓库并进入项目目录,后续所有命令都在该目录下执行。

    git clone https://github.com/wzpan/wukong-robot.git
    cd wukong-robot
  2. 2确认 Python 版本

    README 要求 Python 3.7 以上,先确认本机 python3 版本满足要求。

    python3 --version
  3. 3按官方教程安装

    README 未给出具体依赖安装命令,需按官方安装教程 https://wukong.hahack.com/#/install 完成环境与依赖安装。

  4. 4启动程序

    在项目目录执行启动脚本。建议在 tmux 或 supervisor 中执行,避免断开终端导致进程退出。

    python3 wukong.py
  5. 5生成配置文件

    第一次启动时会提示是否到用户目录创建配置文件,输入 y 即可;不建议直接修改 default.yml。

    y
  6. 6访问后台管理端

    程序运行期间会启动后台管理端,可远程对话、查看修改配置、查看 log。

关键配置

配置项必填说明示例
$HOME/.wukong/config.yml是用户配置文件,运行时读取;README 建议拷贝一份到这里而不是改 default.yml/home/pi/.wukong/config.yml
唤醒词否默认唤醒词为 snowboy,可从配置文件自定义snowboy
后台管理端地址否默认后台管理端访问地址http://localhost:5001
默认账户名否后台管理端默认用户名,正式使用建议修改wukong
默认密码否后台管理端默认密码,正式使用建议修改以免泄漏隐私wukong@2019
厂商 API 应用信息是各语音/语义厂商的 API 建议注册并填自己申请的应用信息,不要用默认配置你的讯飞/百度应用 AppID 与 Key

如何确认成功

终端执行 python3 wukong.py 无报错并进入监听状态,说出唤醒词“snowboy”能被唤醒应答;浏览器打开 http://localhost:5001 可用 wukong / wukong@2019 登录。

常见问题

Q:第一次启动提示是否创建配置文件,该怎么选?

A:输入 y,程序会在用户目录下创建配置文件,之后按需修改该文件即可,不要直接改项目里的 default.yml。

Q:后台管理端地址和账号是什么?

A:默认地址 http://localhost:5001,默认账户名 wukong,密码 wukong@2019;正式使用建议修改用户名和密码,以免泄漏隐私。

Q:怎么自定义唤醒词?

A:默认唤醒词是“snowboy”,README 说明该唤醒词可自定义,通过配置文件修改。

Q:为什么建议自己注册厂商 API 而不是用默认配置?

A:这些 API 都有使用频率和并发数限制,过多人同时使用会影响服务质量,所以建议注册并填上自己申请的应用信息。

Q:为什么不建议直接修改 default.yml?

A:直接改 default.yml 会给后续通过 git pull 更新带来麻烦,应拷贝一份到 $HOME/.wukong/config.yml。

注意事项

  • README 未给出具体安装依赖命令,完整安装步骤以官方教程 https://wukong.hahack.com/#/install 为准。
  • 建议在 tmux 或 supervisor 中运行,避免终端断开导致机器人退出。
  • 配置文件应放在 $HOME/.wukong/config.yml,或在首次运行时按提示让程序自动生成。
  • 正式使用时请修改后台管理端的默认用户名与密码。

核心亮点

  • 集成 ChatGPT,对话更智能,多轮交互自然
  • 支持脑机接口,开源智能音箱中首创,玩法独特
  • 插件系统丰富,可扩展家居控制、音乐播放等技能

不足之处

  • 依赖多个外部语音服务,部分功能需付费 API
  • 文档和社区规模较小,新手入门可能遇到坑

适用场景

  • DIY 智能音箱硬件项目
  • 语音交互应用开发原型
  • 脑机接口技术实验平台

替代项目

Mycroft、OpenAssistant、Home Assistant 的语音组件

项目介绍

wukong-robot 是对话助手领域的开源项目,由 wzpan 开发,2019 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(7,129)位列前 7%,在对话助手分类的 907 个项目里位列前 5%。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。MIT许可证,完全免费,可自行部署使用。

它主要面向的使用场景是:DIY智能音箱硬件项目。同类可对比的替代方案包括 Mycroft、OpenAssistant、Home Assistant 的语音组件。

上一篇:lobe-chat

下一篇:alts

同类项目推荐

open-webui 开源

给本地模型配个漂亮聊天室,全家都能用

User-friendly AI Interface (Supports Ollama, OpenAI API, ...)

★ 152821 2026-08-09
prompts.chat 开源

海量好提示词,抄了就能让 AI 更听话

f.k.a. Awesome ChatGPT Prompts. Share, discover, and collect prompts from the commun···

★ 170999 2026-08-09
elia 开源

终端里用键盘快速聊 AI,多模型切换不打断思路

A snappy, keyboard-centric terminal user interface for interacting with large langua···

★ 2479 2026-08-09
NextChat 开源

一个界面聊遍所有主流AI模型,支持全平台部署,轻快又私密。

✨ Zero-config AI chat assistant. No API key needed — sign up and instantly chat wi···

★ 88802 2026-08-09