audio.cpp-webui 是音频音乐领域的开源项目,由 kigner 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 764 个项目,GitHub 星标数为 375。
项目仍在小幅维护中,最近一次代码更新于 2026-08-14。本地部署,无在线服务,完全免费。
它主要面向的使用场景是:本地离线语音助手开发。同类可对比的替代方案包括 whisper.cpp、llama.cpp、stable-diffusion.cpp。

纯 C++ 音频 AI 全家桶,网页即开即用,无需 Python
audio.cpp-webui 是一个基于 ggml 的纯 C++ 音频模型推理引擎,为 audio.cpp 提供全任务 WebUI。它支持语音合成(TTS)、语音识别(ASR/STT)、语音活动检测(VAD)、声音转换、说话人分离和音乐生成,且无 Python 依赖。项目旨在解决音频 AI 模型部署中依赖重、环境复杂的问题,通过 C++ 实现高效推理,并提供友好的 Web 界面,让用户能便捷地使用多种音频 AI 能力。其核心能力包括多任务音频处理、本地化推理和轻量级部署,适合边缘设备或对性能有要求的场景。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
—
whisper.cpp、llama.cpp、stable-diffusion.cpp
audio.cpp-webui 是音频音乐领域的开源项目,由 kigner 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 764 个项目,GitHub 星标数为 375。
项目仍在小幅维护中,最近一次代码更新于 2026-08-14。本地部署,无在线服务,完全免费。
它主要面向的使用场景是:本地离线语音助手开发。同类可对比的替代方案包括 whisper.cpp、llama.cpp、stable-diffusion.cpp。
上一篇:ACE-Step-Studio
下一篇:VODER
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
VoiceStudio
开源
开源语音全能工作站,克隆、配音、转录一站式搞定
VoiceStudio is the open-source, fully-local ElevenLabs alternative — voice cloning,···
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···