botium-speech-processing

让语音应用自动化测试像聊天测试一样简单,打通STT/TTS全链路

Botium Speech Processing 是一个用于语音处理测试的开源工具集,隶属于 Botium 测试框架生态。它主要解决在自动化测试中如何对语音交互应用(如智能音箱、语音助手)进行端到端测试的问题,核心能力包括将语音输入转换为文本(STT)以及将文本响应合成为语音(TTS),从而模拟真实用户与语音应用的交互流程。该项目支持多种主流语音服务提供商(如 Google、Amazon、IBM、Azure 等)的集成,并提供了统一的 API 接口,使得测试脚本可以无缝切换底层语音引擎。通过将语音处理能力嵌入到 Botium 的测试流程中,开发者可以编写自然语言测试用例,自动验证语音应用的响应内容、意图识别和对话逻辑,而无需手动操作录音和回放。项目采用 JavaScript 编写,易于扩展和定制,适合需要持续集成和回归测试的语音产品团队。

开源 unknown 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 943
维护状态 较活跃
是否开源
定价模式 unknown

项目数据

分类音频音乐
开发团队codeforequity-at
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源
开源协议MIT
主要语言JavaScript
技术栈/模型botium,speech-to-text,text-to-speech
GitHub 星标★ 943
30天Star增速
HF 下载量
上线时间2019-12-03 00:00:00
最近更新2026-09-02 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 统一封装多种主流STT/TTS服务,切换引擎无需改测试代码
  • 与Botium框架深度集成,可直接复用现有对话测试用例
  • 提供语音模拟输入和输出断言,支持端到端语音交互验证

不足之处

  • 文档相对简略,新手上手需要参考Botium主项目资料
  • 依赖外部语音服务,离线或网络受限环境难以使用

适用场景

  • 智能音箱/语音助手的功能回归测试
  • 语音交互应用的自动化验收测试
  • 多语言语音引擎的对比测试与选型

替代项目

Appium、Selenium、Botium

项目介绍

botium-speech-processing 是语音识别领域的开源项目,由 codeforequity-at 开发,2019 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(943)位列前 30%,在语音识别分类中处于中上游。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-02。从国内网络环境看,当前已无法正常访问。

它主要面向的使用场景是:智能音箱/语音助手的功能回归测试。同类可对比的替代方案包括 Appium、Selenium、Botium。

上一篇:speech-swift

下一篇:curses

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13