OSSSpeechKit

几行 Swift 代码,让 iOS 应用轻松拥有语音识别与合成能力。

OSSSpeechKit 是一个面向 iOS 开发者的原生语音工具包,基于 AVFoundation 和 Apple 的 Speech 框架封装,提供简洁的 Swift API 来实现语音转文字(STT)和文字转语音(TTS)功能。它解决了开发者直接使用系统底层框架时代码繁琐、配置复杂的问题,通过统一的接口和 CocoaPods 支持,让集成语音能力变得快速简单。核心能力包括实时语音识别、音频文件转写、语音合成播报,并支持自定义识别语言和语音参数。项目采用 Swift 5 编写,注重类型安全和易用性,适合在 iOS 应用中快速添加语音交互功能。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 184
维护状态 维护中
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队AppDevGuy
所属国家
官网地址
定价模式free
价格说明开源库,MIT许可证,完全免费,无付费版本。
访问状态
是否开源
开源协议MIT
主要语言Swift
技术栈/模型avfoundation,cocoapod,ios,pod,speech,speech-api,speech-recognition,speech-to-text,swift,swift5,text-to-speech
GitHub 星标★ 184
30天Star增速
HF 下载量
上线时间2019-06-06 00:00:00
最近更新2026-07-13 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

核心亮点

  • 封装了 Apple Speech 框架,API 简洁,集成成本低
  • 同时支持语音识别和语音合成,覆盖常见语音场景
  • 基于原生框架,性能和隐私性优于第三方云服务

不足之处

  • 项目处于早期阶段,功能覆盖和稳定性待验证
  • 文档和示例相对简略,上手可能需要参考源码

适用场景

  • 在 iOS 应用中快速添加语音输入功能
  • 实现文字转语音播报,如阅读辅助或通知播报
  • 对本地音频文件进行离线语音转写

替代项目

SpeechRecognizer、SFSpeechRecognizer、AVSpeechSynthesizer

项目介绍

OSSSpeechKit 是语音识别领域的开源项目,由 AppDevGuy 开发,2019 年首次发布。

它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 184。

项目仍在小幅维护中,最近一次代码更新于 2026-07-13。开源库,MIT许可证,完全免费,无付费版本。

它主要面向的使用场景是:在iOS应用中快速添加语音输入功能。同类可对比的替代方案包括 SpeechRecognizer、SFSpeechRecognizer、AVSpeechSynthesizer。

上一篇:whisper-auto-transcribe

下一篇:WhisperTimeSync

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13