ten-turn-detection 是语音识别领域的开源项目,由 TEN-framework 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 615。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-23。无官网,需自行部署,完全免费。
它主要面向的使用场景是:实时语音助手(如智能音箱)的对话管理。同类可对比的替代方案包括 SpeechBrain、pyannote.audio、NeMo。

实时判断对话转折点,让AI插话自然不尴尬
ten-turn-detection 是一个用于全双工对话通信的转折点检测开源模型。它解决的是在实时语音对话中,如何准确判断用户何时说完、何时应该由AI接管发言的问题,这是实现自然流畅的语音交互体验的关键技术。该模型基于Python实现,通过分析语音或文本流中的语义和韵律特征,实时预测对话中的转折点,从而支持打断、插话和快速响应。其核心能力包括高精度的端点检测、低延迟的推理速度以及对多语言对话的适应性。项目目前处于早期阶段,但已提供预训练模型和推理示例,便于开发者集成到语音助手、客服机器人等系统中。
SpeechBrain、pyannote.audio、NeMo
ten-turn-detection 是语音识别领域的开源项目,由 TEN-framework 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 615。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-23。无官网,需自行部署,完全免费。
它主要面向的使用场景是:实时语音助手(如智能音箱)的对话管理。同类可对比的替代方案包括 SpeechBrain、pyannote.audio、NeMo。
上一篇:Llama-AVSR
下一篇:MLC-SLM-Baseline
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper