
GitHub 星标
★ 1136
维护状态
活跃
是否开源
是
定价模式
free
项目数据
分类语音识别
开发团队xzf-thu
所属国家
定价模式free
价格说明开源项目,免费使用,定价信息待确认
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型asr,robust
GitHub 星标★ 1136
30天Star增速
HF 下载量
上线时间2026-05-16 00:00:00
最近更新2026-09-02 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-01
浏览次数2
核心亮点
- 覆盖7种原子声学条件和54种复合场景,训练数据达260万条,真实场景适应性强
- 在噪声、远场等挑战性环境下比现有SOTA模型最多提升30%准确率
- 提供开箱即用的Python接口,易于集成到实际语音应用中
不足之处
- 文档/社区待观察
- 模型体积和推理速度未公开,可能影响资源受限场景部署
适用场景
- 嘈杂环境下的语音助手(如车载、工业现场)
- 远场会议录音转写
- 智能安防监控中的语音识别
替代项目
Whisper、Kaldi、ESPnet
项目介绍
下一篇:wenet
同类项目推荐
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
cheetah
开源
在设备上实时把语音转文字,离线低延迟还保护隐私
On-device streaming speech-to-text engine powered by deep learning