speechgpt

和 ChatGPT 直接说话,解放双手,练口语更自然

SpeechGPT 是一个基于网页的语音对话应用,让你能直接与 ChatGPT 进行语音交流,而不是打字。它解决了用户在使用 ChatGPT 时只能通过文本交互的局限,提供了更自然、更便捷的对话体验。其核心能力包括:通过浏览器麦克风捕捉语音,利用语音识别技术将用户语音转为文本,再发送给 ChatGPT 获取回复,最后通过语音合成技术将回复朗读出来,实现全语音的闭环对话。项目基于 TypeScript 开发,技术栈涉及聊天、语音处理和语言学习,特别适合用于口语练习、语音助手等场景。界面简洁,易于部署,是一个轻量级的开源实现,为开发者提供了语音交互的参考范例。

开源 unknown 对话助手
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 2750
维护状态 维护中
是否开源 是
定价模式 unknown

项目数据

分类对话助手
开发团队hahahumble
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型chat,chatbot,chatgpt,conversation,language-learning,speech
GitHub 星标★ 2750
30天Star增速
HF 下载量
上线时间2023-03-28 00:00:00
最近更新2026-09-18 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

难度:入门 约 10 分钟 部署方式:Docker 5 步

环境要求

  • 已安装 Docker 环境(可执行 docker 命令)
  • 一个可用的 OpenAI API Key
  • 支持麦克风的现代浏览器并允许录音权限
  • 能访问 Docker Hub 拉取镜像的网络环境

安装与启动步骤

  1. 1拉取镜像

    从 Docker Hub 拉取官方镜像 hahahumble/speechgpt,README 标注该镜像为 arm64 架构,其他架构请留意兼容性。

    docker pull hahahumble/speechgpt
  2. 2启动容器

    后台运行容器并把容器 8080 端口映射到本机 8080,容器命名为 speechgpt,方便后续管理。

    docker run -d -p 8080:8080 --name speechgpt hahahumble/speechgpt
  3. 3访问应用

    在浏览器打开 http://localhost:8080/ ,能看到 SpeechGPT 界面即部署成功。

  4. 4配置 API Key

    进入 Settings 设置页,在 Chat 相关配置中填入 OpenAI API Key,保存后才能正常对话。

  5. 5源码构建镜像

    如需自行构建,先克隆项目到本地,在项目根目录用 Dockerfile 构建镜像,再运行容器。

    git clone https://github.com/hahahumble/speechgpt.git
    cd speechgpt
    docker build -t speechgpt:arm64 -f Dockerfile .
    docker run -d -p 8080:8080 --name=speechgpt speechgpt

关键配置

配置项必填说明示例
OpenAI API Key是在应用 Settings 中填入,用于调用 ChatGPT 获取回复sk-xxxxxxxxxxxxxxxx
端口映射 8080否docker run 的 -p 参数,默认映射容器 8080 端口8080:8080

如何确认成功

浏览器访问 http://localhost:8080/ 能正常打开应用界面,并在 Settings 保存 API Key 后完成一次语音对话。

常见问题

Q:不填 OpenAI API Key 能用吗?

A:不能。README 教程第一步就是设置 OpenAI API Key,需前往 Settings 的 Chat 相关配置中填入,否则无法获取 ChatGPT 回复。

Q:8080 端口被占用怎么办?

A:修改 docker run 的 -p 参数,例如 -p 9090:8080,然后访问 http://localhost:9090/ 即可。

Q:镜像在其他 CPU 架构上能跑吗?

A:README 中拉取的镜像标注为 arm64,若你的机器是其他架构,可参考「源码构建镜像」步骤用项目 Dockerfile 自行构建。

Q:必须用 Docker 部署吗?

A:不是。README 还列出了 Vercel 部署方式,但未给出具体操作步骤,可参考官方文档或直接使用官网 speechgpt.app。

注意事项

  • 所有数据存储在本地,隐私性较好,但 API Key 也保存在浏览器本地,请勿在公共设备上填写。
  • 语音识别与语音合成支持浏览器内置能力,也支持 Azure Speech Services、Amazon Polly 等外部服务,按需在设置中切换。
  • README 的 Vercel 部署章节没有给出具体命令,本教程未做推测。
  • 初次使用需授权浏览器麦克风权限,否则无法录音。

核心亮点

  • 实现语音输入到语音输出的完整对话闭环,交互自然
  • 基于 TypeScript,代码结构清晰,易于二次开发
  • 轻量级 Web 应用,部署简单,开箱即用

不足之处

  • 依赖第三方语音识别和合成服务,可能存在延迟或费用
  • 文档/社区待观察

适用场景

  • 语言学习者进行口语对话练习
  • 需要免提操作的场景(如驾驶、做家务时)
  • 快速搭建语音聊天机器人原型

替代项目

voice-chatgpt、chatgpt-web、lobe-chat

项目介绍

speechgpt 是对话助手领域的开源项目,由 hahahumble 开发,2023 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(2,750)位列前 30%,在对话助手分类的 905 个项目里位列前 10%。

项目仍在小幅维护中,最近一次代码更新于 2026-09-18。从国内网络环境看,可直接访问。

它主要面向的使用场景是:语言学习者进行口语对话练习。同类可对比的替代方案包括 voice-chatgpt、chatgpt-web、lobe-chat。

上一篇:cskefu

下一篇:maid

同类项目推荐

open-webui 开源

给本地模型配个漂亮聊天室,全家都能用

User-friendly AI Interface (Supports Ollama, OpenAI API, ...)

★ 152821 2026-08-09
prompts.chat 开源

海量好提示词,抄了就能让 AI 更听话

f.k.a. Awesome ChatGPT Prompts. Share, discover, and collect prompts from the commun···

★ 170999 2026-08-09
elia 开源

终端里用键盘快速聊 AI,多模型切换不打断思路

A snappy, keyboard-centric terminal user interface for interacting with large langua···

★ 2479 2026-08-09
NextChat 开源

一个界面聊遍所有主流AI模型,支持全平台部署,轻快又私密。

✨ Zero-config AI chat assistant. No API key needed — sign up and instantly chat wi···

★ 88802 2026-08-09