orca

本地流式语音合成,离线也能实时开口

Orca 是一个基于深度学习的端侧流式文本转语音(TTS)引擎,用 Python 实现。它解决的是传统 TTS 依赖云端服务、延迟高、隐私风险大、离线不可用的问题,让语音合成直接在本地设备上完成。核心能力包括流式推理,即边生成边播放,降低首包延迟;端侧运行,无需联网即可工作,适合隐私敏感或网络受限环境;深度学习驱动,保证合成语音的自然度。项目当前处于早期阶段,星标约 146,代码以 Python 为主,方便二次开发和集成到现有 Python 应用。它适合需要实时语音反馈、离线语音播报、或对数据隐私有要求的场景,例如本地语音助手、无障碍阅读工具、嵌入式语音交互设备。开发者可以基于它快速搭建原型,但生产环境需评估性能与稳定性。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 146
维护状态 较活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类音频音乐
开发团队Picovoice
所属国家
官网地址
定价模式free
价格说明开源项目,免费使用
访问状态
是否开源是
开源协议Apache-2.0
主要语言Python
技术栈/模型
GitHub 星标★ 146
30天Star增速
HF 下载量
上线时间2024-01-22 00:00:00
最近更新2026-09-14 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-01
浏览次数0

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

使用教程

核心亮点

  • 流式推理支持边生成边播放,降低首包延迟
  • 完全端侧运行,无需联网,保护隐私
  • Python 实现,易于集成和二次开发

不足之处

  • 项目早期,星标少,社区和文档待完善
  • 端侧性能与音质平衡需实际测试验证

适用场景

  • 离线语音助手或嵌入式设备的实时语音播报
  • 隐私敏感场景下的本地文本转语音,如医疗、金融
  • 无障碍阅读工具,为视障用户实时朗读文本

替代项目

Coqui TTS、Piper、Festival

项目介绍

orca 是音频音乐领域的开源项目,由 Picovoice 开发,2024 年首次发布。

它收录于音频音乐分类,该分类目前共有 757 个项目,GitHub 星标数为 146。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-14。免费使用。

它主要面向的使用场景是:离线语音助手或嵌入式设备的实时语音播报。同类可对比的替代方案包括 Coqui TTS、Piper、Festival。

上一篇:ElundusCoreApp

下一篇:VoicEra

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1241 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1413 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 250 2026-08-09