voice-activity-detection

本站收录 14 个带「voice-activity-detection」标签的 AI 开源项目

FunASRFunASR 是阿里开源的多语言语音识别工具包,专为中文场景深度优化,同时支持英文、日文等。它解决了从训练到部署的全链路问题,包括语音识别(ASR)、端点检测(★ 20,549FluidAudioFluidAudio 是一个面向 iOS/macOS 开发者的 Swift 框架,旨在将前沿的 CoreML 音频模型无缝集成到原生应用中。它解决了开发者难以在★ 2,927pluelypluely 是一个开源的 AI 实时助手,定位为 Cluely 的替代品,专为会议、面试和日常对话场景设计。它通过 Tauri 框架构建,安装包仅 10MB,★ 2,698open-speech-corpora这是一个收录可公开获取的语音语料库的清单项目,旨在为语音技术研究与开发提供资源导航。它系统整理了用于自动语音识别(ASR)、语音合成(TTS)、语音情感识别、语★ 1,404speech-swiftspeech-swift 是一个专为 Apple Silicon 设备打造的 AI 语音工具包,基于 MLX 和 CoreML 框架,提供端侧语音识别(ASR)★ 1,203whisper.netWhisper.net 是 OpenAI Whisper 语音识别模型的 .NET 封装库,让 C# 开发者无需直接处理底层推理代码,就能在应用中集成语音转文字★ 946AliceAlice 是一个以语音优先的桌面 AI 助手应用,基于 Vue.js、Vite 和 Electron 构建。它旨在解决传统 AI 助手交互繁琐、记忆能力弱、难★ 320cobraCobra 是一个基于深度学习的设备端语音活动检测(VAD)工具,由 Picovoice 开源。它解决的核心问题是:在语音识别、语音唤醒或录音系统中,如何准确判★ 270whisper-auto-transcribe这是一个基于 OpenAI Whisper 的自动音频转写工具,旨在提供简单易用的语音转文本解决方案。它解决了普通用户在使用 Whisper 时面临的命令行操作★ 229speech-androidspeech-android 是一个面向 Android 平台的端侧语音 SDK,基于 ONNX Runtime 并利用高通 NNAPI 加速,提供语音识别(A★ 163speech-corespeech-core 是一个面向端侧设备的实时语音智能体流水线,用 C++17 编写,基于 ONNX Runtime 和 LiteRT(TensorFlow ★ 90spokestack-androidSpokestack Android 是一个面向 Android 平台的可扩展移动语音框架,旨在帮助开发者快速为应用集成完整的语音交互能力。它涵盖唤醒词检测、自★ 74react-native-spokestackreact-native-spokestack 是一个为 React Native 应用提供语音接口的官方 SDK,它封装了 Spokestack 的 iOS ★ 60py-nltoolspy-nltools 是一组用于口语自然语言处理的基础 Python 模块,旨在为语音相关的 NLP 任务提供轻量级工具集。它解决的是从原始语音或文本中提取语言★ 55