VoicEra 是音频音乐领域的开源项目,由 COSS-India 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 757 个项目,GitHub 星标数为 313。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-29。开源项目。
它主要面向的使用场景是:企业搭建私有化AI电话客服,接听客户来电并自动应答。同类可对比的替代方案包括 Vocode、Pipecat、Jambonz。

开源语音AI模块,接上电话就能让LLM打电话对话
VoicEra 是一个开源的语音 AI 构建模块,主打电话集成能力,帮助开发者快速搭建可打电话的对话式 AI 智能体。它把实时语音转文字(STT)、文字转语音(TTS)和大语言模型(LLM)驱动的对话逻辑整合在一起,并内置电话线路接入,让 AI 能直接接听和拨打电话。项目解决的是从零搭建语音机器人时链路复杂、组件割裂的问题:传统方案需要分别对接 ASR、TTS、LLM、电话网关和会话管理,VoicEra 把这些打包成可复用的模块,支持本地 LLM 和本地部署,适合对数据隐私和私有化有要求的场景。核心能力包括实时语音识别、自然语音合成、多轮对话代理、呼入呼出电话处理,以及无需写代码的配置方式。整体用 Python 编写,面向客服、外呼、预约提醒等语音交互场景。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
Vocode、Pipecat、Jambonz
VoicEra 是音频音乐领域的开源项目,由 COSS-India 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 757 个项目,GitHub 星标数为 313。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-29。开源项目。
它主要面向的使用场景是:企业搭建私有化AI电话客服,接听客户来电并自动应答。同类可对比的替代方案包括 Vocode、Pipecat、Jambonz。
上一篇:orca
下一篇:omnivoice.cpp
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···