SmartSpeaker

用STM32+ESP8266自造一台能联网听话的智能音箱

SmartSpeaker 是一个用 C 语言编写的开源智能音箱项目,硬件基于 STM32F407 主控、WM8978 音频编解码芯片和 ESP8266 WiFi 模块,整体方案对标天猫精灵、小爱同学这类云端语音助手。它要解决的问题是:让开发者用低成本、可自行采购的通用元器件,搭出一台能联网、能听会说、能响应语音指令的智能控制设备,而不是依赖厂商封闭的成品音箱。核心能力包括:通过 WM8978 完成麦克风采集与扬声器播放,借助 ESP8266 把音频上传到云端语音识别服务,拿到识别文本后执行对应控制动作,并在 FreeRTOS 上调度多任务,保证录音、联网、播放等流程并行不冲突。项目适合作为嵌入式语音交互的入门范本,帮助理解从声音采集、网络传输到云端识别、本地执行的完整链路,也方便在此基础上扩展家居控制等功能。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 310
维护状态 活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类语音识别
开发团队lovelyterry
所属国家
官网地址
定价模式free
价格说明开源硬件项目,无定价信息
访问状态
是否开源是
开源协议MIT
主要语言C
技术栈/模型esp8266,freertos,speech-recognition,stm32,wm8978
GitHub 星标★ 310
30天Star增速
HF 下载量
上线时间2018-07-28 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-03
浏览次数0

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

核心亮点

  • 硬件选型常见且便宜,STM32F407、WM8978、ESP8266 都容易买到,复刻成本低
  • 完整跑通了麦克风采集、WiFi 上传、云端识别、本地执行的闭环链路,参考价值高
  • 基于 FreeRTOS 做多任务调度,能学到嵌入式实时系统与音频、网络任务并行的实际写法

不足之处

  • 依赖云端语音识别服务,项目本身不含离线识别能力,服务变更或停用会影响可用性
  • 作为早期项目,文档和社区活跃度有限,新手上手可能需要自行摸索硬件连接与云端配置

适用场景

  • 嵌入式学习者复刻一台低成本智能音箱,理解语音交互全链路
  • 在智能家居原型中接入语音控制,用语音开关灯、控制电器
  • 作为 STM32+FreeRTOS+WiFi 的综合练手项目,练习多任务与音频、网络编程

替代项目

xiaomi-ai-speaker、AlexaAVS、Rhasspy

项目介绍

SmartSpeaker 是语音识别领域的开源项目,由 lovelyterry 开发,2018 年首次发布。

它收录于语音识别分类,该分类目前共有 249 个项目,GitHub 星标数为 310。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-28。开源硬件项目,无定价信息。

它主要面向的使用场景是:嵌入式学习者复刻一台低成本智能音箱,理解语音交互全链路。同类可对比的替代方案包括 xiaomi-ai-speaker、AlexaAVS、Rhasspy。

上一篇:VibeASR.cpp

下一篇:phonon

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1619 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3786 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11851 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5659 2026-08-13