WhisperHallu 是语音识别领域的开源项目,由 EtienneAb3d 开发,2023 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 351。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-26。代码免费,需自行部署使用。
它主要面向的使用场景是:会议录音转写,去除空白段和噪声干扰。同类可对比的替代方案包括 WhisperX、faster-whisper、stable-ts。

预处理音频,让 Whisper 转录不再胡说八道
WhisperHallu 是一个实验性开源项目,专注于音频预处理,旨在减少 OpenAI Whisper 语音识别模型产生的幻觉文本(即模型在无语音片段中虚构输出内容)。它通过一系列音频处理技术,如语音活动检测(VAD)、噪声去除、人声分离等,对输入音频文件进行清洗和优化,从而提升 Whisper 转录的准确性和可靠性。项目核心能力包括:自动检测并移除静音或非语音片段,降低背景噪声干扰,分离并增强人声信号,最终生成更干净的音频输入,显著减少幻觉文本的出现。它主要面向需要高精度转录的开发者、研究人员和内容创作者,提供了一套可配置的预处理流程,并支持与 Whisper 模型无缝集成。
WhisperX、faster-whisper、stable-ts
WhisperHallu 是语音识别领域的开源项目,由 EtienneAb3d 开发,2023 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 351。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-26。代码免费,需自行部署使用。
它主要面向的使用场景是:会议录音转写,去除空白段和噪声干扰。同类可对比的替代方案包括 WhisperX、faster-whisper、stable-ts。
上一篇:izwi
下一篇:Speech-and-Text
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper